往期日报
查看往期内容,汇聚 AI 前沿资讯,重要信息尽收眼底。
Anthropic披露186页风险报告,未监控Agent曾在敏感集群越权并删除大量任务; 英伟达正洽谈向SB Energy投资30亿美元,参与10吉瓦AI数据中心园区供电建设; 亚马逊自出版样本中AI书籍占目录20%,八类体裁中七类的人类作者单书收入下降
SpaceX正式收购Cursor,后者将使用其大规模GPU资源训练编程模型; GLM-5.3支持1M上下文,CyberGym得分84.5%,智谱承诺两周内开放权重; 小红书开源总参数280B、激活16B且支持512K上下文的三模态dots3-note模型
Gemini 3.7 Flash的DeepSWE得分升至65.3%,首发输入价为每百万token 0.75美元; ChatGPT Computer History通过桌面交互事件为ChatGPT与Codex提供跨应用上下文; GPT-5.6 Sol Ultrafast最高达750 token/秒,速度提升最高14倍
阿里开放2.4万亿参数Qwen3.8权重,每个Token激活950亿参数并支持原生256K上下文; Lovable完成4亿美元C轮融资,估值达133亿美元、年化收入接近6亿美元; Google研究显示前沿模型95%至98%的事实已编码,但直接回忆失败率仍达26%至34%
主流LLM API曾可通过跨模型重放解密推理轨迹,OpenAI、Anthropic和Google已修复; NVIDIA联合六家金融机构推动超过5000亿美元AI基础设施融资,单个项目支持最高可达25%; Nemotron 3.5 Lightning仅激活3B参数,路由测试将代理成本降低约70%
OpenAI发布GPT-5.6-Cyber并称其已发现Chrome V8未知漏洞,仅向获批防御人员开放; Claude研究版本将黎曼ζ函数相关比例下界从41.6%提高至67.2%; Meta开放30B参数Muse Glimmer,约128K上下文且4比特版本占用不足20GB显存
GPT-5.6与Fable 5协助证明MIMO检测算法可在2logN阈值以O(N³)计算量精确恢复; 联合国设立首个参照IPCC运行的独立国际AI科学小组; TarantuBench-v2提供1万个带双层reward hacking检测的网络安全实验环境
欧盟将AI销售代理高风险义务推迟至2027年12月,但AI身份披露与合成音频标记仍有效; Google据报洽购AI编程公司Mechanize,潜在交易额超过15亿美元; Kimi K3在安全测试中逃离沙箱并通过公网寻找答案,但未继续攻击外部系统
OpenAI称Astra可能达到Critical网络安全能力门槛,并强化隔离测试与权重保护; AMD收购Taalas,其HC1在Llama 3.1 8B上达到每秒约1.7万token; AWS上线DynamoDB原生向量搜索,支持4096维向量且召回率超过99%