返回往期
2026年8月20日星期四
10 点要闻3 分钟阅读

今日要闻

1

OpenAI为前沿模型提供零数据保留,9月上线隐私安全处理

数据隐私AI安全企业服务

OpenAI宣布向符合条件的API客户提供前沿模型零数据保留:请求处理后不保存提示词或响应,除非客户明确选择用于训练。同步预览的Private Safety Processing可在客户控制或加密存储上识别跨交互滥用模式,仅向OpenAI返回窄化风险信号,员工无法查看原始内容。客户可自行调查并决定是否披露信息;系统拟于2026年9月开始推出并发布技术白皮书,儿童性虐待材料检测因法律义务例外。

阅读原文
2

Cerebras发布CS-4,宣称推理速度达GPU系统30倍

AI芯片推理基础设施

Cerebras于8月18日发布新一代AI计算机CS-4,宣称推理速度可达GPU系统的30倍,并可支持超过10万亿参数的模型,以每秒超过1000个token输出。公司同时公布模块化Nexus架构和解耦推理方案,试图按工作负载重新组织计算资源。CS-4计划在第三季度广泛推出;上述性能均为厂商口径,材料未给出独立测试、具体价格或与英伟达系统的同条件基准,实际部署表现仍待验证。

3

Etched融资7亿美元,26天内估值升至210亿美元

融资AI芯片

Etched在约26天内完成7亿美元融资,估值由约103亿美元升至210亿美元,增幅超过一倍。Jane Street领投本轮,并成为Etched芯片的首个客户,使资本投入与早期商业采用同时落地。材料称,该公司将芯片从测试推进到实际运行仅用44天,显示其硬件验证和交付节奏较快。此次交易把Etched推入高估值AI芯片创业公司行列,但材料未提供芯片性能、量产规模、融资条款或后续交付时间表。

4

OpenRouter确认加入Stripe,承诺维持多模型网关中立性

并购模型基础设施支付

OpenRouter正式宣布将加入Stripe,双方计划结合多模型路由能力与支付、风控等金融基础设施,支持不断扩大的模型调用和交易规模。OpenRouter表示,其API、产品路线及模型无关的中立网关定位将保持不变,继续服务采用不同模型的开发者。此次公告使此前的收购报道获得公司层面确认,但现有材料未披露交易金额、完成时间、监管条件或整合安排,关于产品独立性与商业条款的长期影响仍需后续观察。

阅读原文
5

GLM-5.3 API上线,后训练推动编码能力提升50%

大模型API模型训练

智谱旗下GLM-5.3 API已上线,继续按每百万token输入1.4美元、输出4.4美元计费,材料称其编码和长周期代理能力得到增强。联合创始人唐杰表示,模型仅通过后训练便将编码能力提升50%,并进一步讨论MoE机制与多维Scaling Law。模型权重目前仍未开源;另一材料称,延迟与其CyberGym得分84.5%、网络安全能力较强有关。API开放使开发者可先行调用,但权重发布时间尚未公布。

阅读原文
6

Google扩展学生AI工具,超140国学生可获一年订阅

AI教育Gemini消费产品

Google推出面向学生的AI学习套件:符合条件的美国大学生可免费使用一年Google AI Pro,全球超过140个国家的学生可获得AI Plus,部分方案提供四倍使用额度和5TB存储。Gemini新增学生中心、学习笔记、诊断测验、互动图表及3D模拟,Gemini Live可通过语音发起后台多步骤Deep Research。Search同步加入自定义测验、Lens分步讲解和学习文件生成,相关功能也将延伸至Google Classroom。

阅读原文
7

NVIDIA FLARE优化多模态联邦学习,更新量由GB降至MB

联邦学习多模态训练基础设施

NVIDIA发布基于FLARE构建联邦多模态AI工作流的方法,重点是在数据不离开本地机构的情况下协同训练视觉语言模型。方案建议冻结大型多模态主干,仅交换LoRA等轻量适配器,使每轮通信量由GB级降至MB级;必须传输较大更新时,可使用张量流式传输绕过消息大小限制,并通过磁盘卸载聚合避免服务器内存随客户端数量线性增长。官方同时建议综合评估模型质量、通信成本、运行时间、内存占用及故障率。

阅读原文
8

Claude托管Agent新增域名控制、持久记忆与成本追踪

AI Agent开发工具安全控制

Anthropic为Claude Managed Agents集中更新安全与运维能力。网页搜索和抓取工具新增allowed_domains与blocked_domains参数,开发者可限定Agent访问的网站范围;Self-Hosted Sandboxes中的工作结果现在可以写入记忆,在后续任务中持续使用。Console会话查看器也针对多Agent工作流重构,加入逐Agent小地图、分组流式记录,以及按线程和会话检查成本的功能,便于追踪并发执行路径、资源消耗与异常行为。

阅读原文
9

Cursor新增长期目标,云端Agent可跨事件持续执行

AI编程AI Agent开发工具

Cursor更新云端Agent,使其能够由外部事件接续工作,并在长时间会话中持续保留目标,直至任务完整结束。新增的「/goal」命令允许用户为Agent设置长期目标,减少复杂工程任务被单轮上下文或中途状态切断的情况。交互控制也得到调整:用户发出转向指令时,可选择等待下一次工具调用再介入,而不是在当前动作执行过程中直接中断。官方材料尚未说明这些功能的套餐限制、默认超时、目标持久化周期或全面开放范围。

阅读原文
10

smolvm隔离运行不可信代码,热启动约50毫秒

代码沙箱AI安全开发工具

smolvm 1.8.3被用于测试不可信Python与JavaScript代码的硬件隔离执行。测试显示,其冷启动耗时约0.6至1.5秒,热执行稳定在约50毫秒,并可同时限制CPU、内存、运行时长和存储配额。离线镜像、禁用网络、只读输入挂载、可写输出目录及非特权模式均按预期工作,适合间歇性数据转换等任务。由于Claude Code网页环境不提供KVM,测试者改用支持KVM的GitHub Actions运行完整测试。

阅读原文

不要错过明天的 AI 简报

数千位专业人士的首选,用 AI Daily Brief 开启每天的工作与生活。