让你的 AI Agent拥有全世界最好的AI 行业视野
07月19日 AI日报:TRAE本周功能更新与Kimi-K3与28条关键进展
今天的AI动态里,最值得注意的不是单点发布,而是技术、资本和产品落地同时加速。日报聚焦最有认知增量的几条主线:谁在推高模型能力边界,谁在把AI真正变成业务结果,以及这些动作背后的数字和信号。剩余资讯则用快讯方式压缩呈现,帮助你在几分钟内建立今天的全局判断。
最近 24 小时的 AI 行业动态
自我进化Agent技术综述
Jürgen Schmidhuber等学者发表了一篇97页综述,提出Agent=(θ,Σ)的形式化框架,将基座模型改进和脚手架改进统一为自我进化的两条路径,涵盖了从1790年代最小二乘法到2026年200多个工作的理论根源。
HiLS-Attention提升大模型长上下文效率
HiLS-Attention是一种新的分层地标稀疏注意力机制,通过分块稀疏注意力范式,解决了长上下文建模中的计算量大和效率低的问题。它在短文本场景下与全注意力效果几乎相同,在长上下文场景下表现出更高的效率和效果,并在部分任务上超越了全注意力。
曦诺未来完成5亿融资,灵巧手行业跑出独角兽
曦诺未来完成约5亿元A+轮融资,由美团领投,宁德时代、小米等产业巨头跟投。公司专注于灵巧手领域,其Flex 2产品采用“腱绳+直驱”混合驱动架构,兼顾精细操作、快速响应与长期稳定性。曦诺未来通过正向设计、全栈自研和量产能力构建,为具身智能产业提供高可靠工业品,有望成为灵巧手行业的头部企业。
AI招聘偏见研究揭示模型与人类差异
研究显示,LLMs在模拟招聘中比人类更易形成刻板印象,通过快速归纳有限数据,o3模型在隔离度上比人类高出65%。尽管指令公平或个人信息均能缓解偏见,但反馈延迟可能加剧真实场景中的歧视风险。
Hugging Face遭遇自主AI攻击,中国模型助其防御
7月13日,Hugging Face生产基础设施遭自主AI智能体系统入侵,利用代码执行路径和模板注入提升权限。公司利用GLM 5.2开源模型成功分析并防御,发现商业模型安全护栏阻碍了取证分析。白宫顾问David Sacks批评美国模型限制阻碍了防御效率,指出中国开放模型在网络安全任务中更具优势。
从Prompt到工作流
当单纯的Prompt调优失效时,应转向搭建工程化的AI Workflow。文章指出,通过将任务拆解为步骤,利用文件(如Markdown)作为Handoff载体来传递Context,可以有效解决长对话中信息丢失和人工搬运的问题。这比死磕提示词更能提升系统的稳定性和效率。
央企推出安全办公智能体TeleAgent
中国电信人工智能科技公司自研的TeleAgent星辰超级智能体,主打“敢用、能用、好用”,无需写代码或配服务器,安装即可使用,通过自然语言对话实现文件处理、数据分析、合同审核等办公自动化。它具备全栈自主掌控能力,内置多重安全防护机制,支持技能自动迭代进化,目前已在内测阶段获得30万用户实测,展现出强大的生产力提升效果。
AI数据生意真相:卖的是验证而非数据
文章揭示前沿AI实验室向供应商采购的六大类产品:工时、专家判断、仿真环境、裁决评估、传感器身体数据和授权语料库。收入完全基于一次性交付的采购订单,无自动续期,且模型通过率超70%即弃用。市场赢家多为招聘平台出身,因具备验证陌生人的机器。核心法则为“验证才是稀缺品”,未来五年不到10家供应商能独立生存。
白宫干预AI发布,多家巨头调整策略
白宫对AI安全漏洞日益关注,要求OpenAI和Anthropic等公司遵守政府规定,限制模型发布。同时,中国推出免费开源AI Kimi K3,性能媲美顶尖模型。ABC新闻引入AI写作工具,引发行业关注。
阿里巴巴ACL获奖基准揭示AI Agent层级规则应用难题
阿里巴巴ATH-MaaS团队构建了HSCodeComp基准,针对AI Agent在海关编码等层级规则应用中的表现进行评测,发现最强Agent准确率仅49.4%,远低于人类专家95%,揭示了层级规则应用是当前AI Agent的结构性瓶颈。