返回往期
2026年8月15日星期六
10 点要闻3 分钟阅读

今日要闻

1

SpaceX收购Cursor,后者将接入大规模GPU资源

并购AI编程算力

Cursor在官方博客宣布已被SpaceX收购,双方自2024年4月开始的合作由此转为并购关系。交易后,Cursor将使用SpaceX的大规模GPU资源训练更强、运行成本更低的编程模型,并继续减少重复编码,让开发者处理更复杂的问题。公司将Grok 4.6视为双方能力结合的早期展示,但未披露交易金额、组织整合安排、产品迁移时间表以及现有用户和定价是否会发生变化。

阅读原文
2

智谱发布GLM-5.3,CyberGym得分84.5%

模型发布AI编程网络安全

智谱发布GLM-5.3,在不更换基础模型的情况下通过后训练扩展强化编程、长周期Agent与网络安全能力,公开基准中的编程能力提升约50%,并在Terminal-Bench 3.0等测试中位居开放模型前列。模型支持最高1M文本上下文,CyberGym得分84.5%;联合安全团队已发现2436个漏洞。智谱承诺两周内开放模型权重,并配套免费安全审计及额度,但完整漏洞利用能力仍落后于前沿闭源模型。

阅读原文
3

Cisco年度AI基础设施订单达93亿美元

AI基础设施行业数据企业市场

Cisco披露,上一季度获得40亿美元超大规模AI基础设施订单,2026财年相关订单总额达到93亿美元,并预计2027财年AI基础设施收入约为75亿美元。数据表明,大型云服务商和算力客户的网络、交换及配套基础设施需求正在形成可确认收入,但订单规模与收入确认并不处于同一周期。材料同时指出企业级SSD价格同比上涨6.5倍,存储成本上升可能进一步抬高整个AI基础设施建设预算。

4

IBM成立OpenAI咨询业务,拟认证数万名顾问

企业AI战略合作咨询服务

IBM宣布成立专门的OpenAI咨询业务,并计划认证数万名顾问,双方将面向金融、政府、电信和零售等行业共同开发与部署AI解决方案。合作重点是把OpenAI模型接入企业核心业务,同时满足安全、治理及行业流程要求,扩大生成式AI在大型机构中的落地范围。材料未披露合作金额、认证计划完成时间、首批客户名单或具体产品定价,因此现阶段主要进展仍是咨询服务体系及行业交付能力的组织化建设。

5

小红书开源dots3-note,支持512K三模态上下文

开源模型多模态AI Agent

小红书开源dots3-note Preview长周期Agent模型,采用MoE架构,总参数280B、每次激活16B,支持512K上下文,可同时处理文本、视觉和音频。模型引入自研TEMPO强化学习方法,将长任务拆分为宏观步骤,并在测试阶段进行价值估计和自我评估,以改善长周期任务的信用分配与策略更新。项目同步开放BF16和FP8版本,并提供Transformers、SGLang及vLLM部署指南,便于开发者本地或集群部署。

阅读原文
6

WALL-B分拣系统达到每小时1816件、成功率98%

具身智能机器人物流自动化

Variable机器人使用标准低成本夹爪与自研WALL-B模型,在真实物流场景中实现每小时1816件的分拣效率和98%成功率,材料称其超过Figure AI每小时1248件的水平。系统可处理圆柱物、生鲜箱和软袋等不规则包裹,依靠模型持续预测物理环境变化,而非配置昂贵的仿人灵巧手。其成功率略高于材料所列人工分拣的97%,显示模型驱动的简化硬件方案已具备减少人工兜底需求的可能性。

阅读原文
7

Talos开源安全Shell Agent,授权令牌30秒失效

AI Agent开源系统安全

Talos开源可获得Shell访问权限的自主Agent,并以确定性安全内核隔离模型提议与最终执行决策。每项操作都需要绑定具体参数的单次授权令牌,令牌仅在30秒内有效;无法提取目标的工具默认拒绝,缺少bubblewrap或sandbox-exec沙箱时也不会运行Shell。项目还通过真实消息验证身份,在无人值守环境自动拒绝需人工审批的操作,并提供只读事件日志及why命令,解释每次允许或拒绝所依据的规则。

阅读原文
8

Molt开源Agent支付协议,为每笔交易生成一次性凭证

AI Agent支付安全开源协议

Molt以Apache 2.0许可证开源面向AI Agent的支付协议,为每次网购生成与商户及购物车金额绑定的一次性支付凭证,交易完成后立即弃用,Agent全程不持有用户真实银行卡信息。该设计假定提示注入必然存在,通过限制收款商户、金额和使用次数缩小凭证泄露后的影响范围。协议无需商户改造,对外仍表现为标准银行卡交易,并提供MCP服务器及purchase、resolve_merchant等工具供Agent程序化调用。

阅读原文
9

RAGless开源无运行时LLM问答,延迟低于150毫秒

RAG开源检索系统

RAGless开源一种不在查询阶段调用LLM的文档问答架构:系统在离线摄取环节预先生成问题变体、答案和来源引用,运行时只执行向量检索与答案映射。其聚合多个问题变体指向同一答案的分数,以提升检索稳定性,官方称延迟低于150毫秒、单次查询成本接近零,并可在普通硬件上部署。该方案将幻觉与审核压力前移至离线阶段,可加入人工复核或Judge模型,但代价是放弃实时生成的灵活性。

阅读原文
10

研究称确定性电脑操作基准可被动作回放攻破

AI评测电脑操作Agent研究

Programma Labs研究指出,部分确定性的电脑操作基准可能奖励预先记录并重复执行的点击、输入和滚动轨迹,而非真正能够观察环境并调整策略的Agent;在这类环境中,Pass-at-K同样可能放大回放优势。团队提出通过变化数据、主题和初始状态,并逐一验证生成配置的有效性、可执行性及可评分性来降低泄漏风险。其DigiWorld方案在多组经验证的Android场景中评估鲁棒性,同时强调应使用可靠置信区间避免小样本差异导致错误选型。

阅读原文

不要错过明天的 AI 简报

数千位专业人士的首选,用 AI Daily Brief 开启每天的工作与生活。