AI 日报

07月19日 AI日报:TRAE本周功能更新与Kimi-K3与28条关键进展

今天的AI动态里,最值得注意的不是单点发布,而是技术、资本和产品落地同时加速。日报聚焦最有认知增量的几条主线:谁在推高模型能力边界,谁在把AI真正变成业务结果,以及这些动作背后的数字和信号。剩余资讯则用快讯方式压缩呈现,帮助你在几分钟内建立今天的全局判断。

阅读日报

最近 24 小时的 AI 行业动态

全部产品会议其他应用投融资报告政策教程科研见解访谈评测资讯更多筛选

自我进化Agent技术综述

Jürgen Schmidhuber等学者发表了一篇97页综述,提出Agent=(θ,Σ)的形式化框架,将基座模型改进和脚手架改进统一为自我进化的两条路径,涵盖了从1790年代最小二乘法到2026年200多个工作的理论根源。

Jürgen SchmidhuberLSTM 之父, 生成式 AI 之父
提出自我进化Agent的全景综述
1 小时前原文
HiLS-Attention提升大模型长上下文效率

HiLS-Attention提升大模型长上下文效率

HiLS-Attention是一种新的分层地标稀疏注意力机制,通过分块稀疏注意力范式,解决了长上下文建模中的计算量大和效率低的问题。它在短文本场景下与全注意力效果几乎相同,在长上下文场景下表现出更高的效率和效果,并在部分任务上超越了全注意力。

1 小时前原文

曦诺未来完成5亿融资,灵巧手行业跑出独角兽

曦诺未来完成约5亿元A+轮融资,由美团领投,宁德时代、小米等产业巨头跟投。公司专注于灵巧手领域,其Flex 2产品采用“腱绳+直驱”混合驱动架构,兼顾精细操作、快速响应与长期稳定性。曦诺未来通过正向设计、全栈自研和量产能力构建,为具身智能产业提供高可靠工业品,有望成为灵巧手行业的头部企业。

夏宇轩创始人兼CEO
从行业演进规律来看,混合驱动并非过渡性方案,而是具身智能走向商用终局的必然路径。
1 小时前原文

AI招聘偏见研究揭示模型与人类差异

研究显示,LLMs在模拟招聘中比人类更易形成刻板印象,通过快速归纳有限数据,o3模型在隔离度上比人类高出65%。尽管指令公平或个人信息均能缓解偏见,但反馈延迟可能加剧真实场景中的歧视风险。

Ryan LiuPhD student
LLMs are eager to create generalizations from limited data.
Angelina WangComputer Scientist
When a chatbot draws on its previous conversation history, it can over-index on the same kinds of behaviors it’s experienced before and form biases.
1 小时前原文

Hugging Face遭遇自主AI攻击,中国模型助其防御

7月13日,Hugging Face生产基础设施遭自主AI智能体系统入侵,利用代码执行路径和模板注入提升权限。公司利用GLM 5.2开源模型成功分析并防御,发现商业模型安全护栏阻碍了取证分析。白宫顾问David Sacks批评美国模型限制阻碍了防御效率,指出中国开放模型在网络安全任务中更具优势。

David Sacks人工智能与加密货币特别顾问
没有理由在美国模型上限制那些中国模型毫无问题就能处理的任务
1 小时前原文

从Prompt到工作流

当单纯的Prompt调优失效时,应转向搭建工程化的AI Workflow。文章指出,通过将任务拆解为步骤,利用文件(如Markdown)作为Handoff载体来传递Context,可以有效解决长对话中信息丢失和人工搬运的问题。这比死磕提示词更能提升系统的稳定性和效率。

leopardracerAuthor
问题点并不在于继续死磕 prompt,而在于早该搭一个 workflow。
2 小时前原文

央企推出安全办公智能体TeleAgent

中国电信人工智能科技公司自研的TeleAgent星辰超级智能体,主打“敢用、能用、好用”,无需写代码或配服务器,安装即可使用,通过自然语言对话实现文件处理、数据分析、合同审核等办公自动化。它具备全栈自主掌控能力,内置多重安全防护机制,支持技能自动迭代进化,目前已在内测阶段获得30万用户实测,展现出强大的生产力提升效果。

黄仁勋
称赞 OpenClaw 是 '当代最重磅的软件'
2 小时前原文

AI数据生意真相:卖的是验证而非数据

文章揭示前沿AI实验室向供应商采购的六大类产品:工时、专家判断、仿真环境、裁决评估、传感器身体数据和授权语料库。收入完全基于一次性交付的采购订单,无自动续期,且模型通过率超70%即弃用。市场赢家多为招聘平台出身,因具备验证陌生人的机器。核心法则为“验证才是稀缺品”,未来五年不到10家供应商能独立生存。

Vikram Aditya连续创业者
凡机器能验证的,机器终将不靠你学会;凡仍需人类说'这是好的'的,会一直付钱给人类。
Alex KarpCEO
硅谷高估了 AI。
2 小时前原文

白宫干预AI发布,多家巨头调整策略

白宫对AI安全漏洞日益关注,要求OpenAI和Anthropic等公司遵守政府规定,限制模型发布。同时,中国推出免费开源AI Kimi K3,性能媲美顶尖模型。ABC新闻引入AI写作工具,引发行业关注。

Samantha SubinWriter
The Trump administration blocked Claude Mythos 5 and Fable 5 due to 'national security concerns'.
Zac HallWriter
Claude for Teachers includes access to both Claude Cowork and Claude Code.
2 小时前原文

阿里巴巴ACL获奖基准揭示AI Agent层级规则应用难题

阿里巴巴ATH-MaaS团队构建了HSCodeComp基准,针对AI Agent在海关编码等层级规则应用中的表现进行评测,发现最强Agent准确率仅49.4%,远低于人类专家95%,揭示了层级规则应用是当前AI Agent的结构性瓶颈。

阿里巴巴 ATH-MaaS 团队应用算法团队
Deep Research Agent 在真实专业场景中存在能力盲区。
3 小时前原文
AI 趋势 — 每日精选全球 AI 资讯与行业报告