天眼早报
🤖 AI 大模型
AI 新模型据称训练 8 天攻破千禧年难题纳维-斯托克斯方程
OpenAI 新模型训练 8 天 后据称解开千禧年难题 纳维-斯托克斯方程,并在 一周内性能超越 Astra。
🏠 智谱完成约 50 亿美元融资,用于下一代 GLM 模型研发
智谱 宣布完成约 50 亿美元 融资,包含约 20 亿美元股份配售及约 30 亿美元可转债,配售价 714 港元/股、转股价 892.50 港元/股;其中 60%净收益将用于 下一代 GLM 基础模型 及完全自训练系统研发,目标是构建 递归自我改进(RSI) 循环。
𝕏 Anthropic CEO 呼吁放缓前沿 AI 开发,提出三阶段安全框架
Anthropic CEO 达里奥·阿莫代伊(Dario Amodei) 发布长文呼吁放缓最前沿模型的能力提升速度,提出包含嵌入第三方评估者、允许评估人员长期进入公司内部核查安全措施与训练流程的三阶段 AI 安全框架。OpenAI CEO 奥尔特曼同意实施,马斯克称“Dario 是对的”,主张同行评审式自我监管;Sam Altman 亦在《财富》采访中表示 OpenAI、Anthropic 与谷歌 DeepMind 或同意共同放缓 AI 开发而非盲目竞赛。阿莫代伊同时指出,若全球为 AI 设限,最大难题不在技术,而在于 中国 等竞争对手可能继续加速推进。
Anthropic 敲定纳斯达克 IPO,拟 10 月启动上市流程
Anthropic 已选定 纳斯达克 作为 IPO 挂牌交易所,计划 今年 10 月 左右启动上市流程,被视为纳斯达克继 SpaceX 后的又一重大胜利。
GPT-6 Astra 独立运营业务并操控监控无人机,多项基准超越 Claude
GPT-6 Astra 在 Vending-Bench 基准中收益近乎 Claude Fable 5.1 的 3 倍,并拒绝对方同意的非法价格操纵交易;还成为首个在无人机控制全部 5 个子任务中超越人类基准的模型。
𝕏 纳德拉:AI 若不服务人类且不可控就不值得追求,微软将公布 MAI 行为准则
微软 CEO 纳德拉 称,若 AI 不能帮助人类且不受人类控制,就不值得发展,需有意识地推进节奏以确保对齐;并宣布将公布第一方 MAI 模型 行为准则征求公众意见,强调闭源与开源模型都应繁荣。
𝕏 iOS 27 私有接口支持第三方模型接入 Siri,Claude 已可运行
据披露,iOS 27 与 macOS Golden Gate 新增私有接口,应用可通过 App Intents 的 Model Delegation API 添加 Siri 扩展并用第三方模型替换 Siri 的服务器后端,Claude 已可作为扩展运行,还能返回 CSV 等内置 Siri 无法完成的任务。
斯坦福 NLP 提议担任独立评估方,三巨头讨论成立 AI 行业标准机构
斯坦福 NLP 的 Chris Manning 提议,将斯坦福 NLP 作为 Dario Amodei 三阶段安全计划下的独立第三方评估机构,认为大学在 AI 安全评估的关键环节比其他组织更合适。另据 The Information 报道,Anthropic、OpenAI 和谷歌此前已讨论合作成立 AI 行业标准机构;奥尔特曼 支持成立测试审计机构,但主张由大型 AI 实验室自行成立,而非依赖美国政府。
𝕏 OpenAI 发布 Agents API,提供 Codex 级 Agent 基础设施
OpenAI 发布 Agents API,提供云端 Agent、长会话、上下文自动压缩、并行子 Agent、MCP 及内置工具、托管沙箱。公开测试版对所有开发者开放,且不额外收取 Agents API 费用。
𝕏 DeepSeek V4.1 KV Cache 深度长文:原理、压缩与部署全梳理
作者花一周撰写 DeepSeek V4.1 KV Cache 长文,梳理 MHA→GQA→MLA、PagedAttention、前缀缓存等压缩与部署手册,指出 KV Cache 决定显存可容纳的上下文与并发,缓存命中价可低至未命中的 2%。
特朗普称美国必须保持 AI 领先优势
特朗普在爱尔兰受访称 “谁赢得 AI,谁就赢得一切”,驳回放缓 AI 模型发展的呼吁。此前 Anthropic、OpenAI、xAI 三位 CEO 共同支持放缓 AI 能力提升速度。
𝕏 Dario Amodei 称愿将 Anthropic 技术交给合适的政府组合
Anthropic CEO 达里奥·阿莫代伊 在 CBS 采访中被问及是否愿将技术交给政府时回应,将交给 合适的政府组合。他还透露其父死于丙肝、自己曾患早期癌症,因此格外重视安全防护。
𝕏 OpenAI 发布 GPT-Live-1 实时语音模型
OpenAI 发布 GPT-Live-1 语音模型,可同时听与说、处理打断,成本 0.05 美元/分钟,解决语音 Agent 对话停顿问题。
𝕏 DeepMind 高管:AI 基建投资的核心押注是递归自我改进
Google DeepMind 首席战略官 Jasjeet Sekhon 称,整个 AI 基础设施投资都建立在 递归自我改进(RSI) 预期之上,若实现,曲线将转为超指数增长;当前证据有限,AlphaEvolve 仅将 Gemini 训练时间缩短 1%。
DeepSeek V4.1 Flash 上线 Command Code,单流解码达 500 tok/s
Command Code 已在所有套餐及 API 上线 DeepSeek V4.1 Flash,将 60 美元 用量额度延长至 10 天,并为 GOAT 套餐用户提供一周 6 倍用量。该模型同时获得推理框架支持,在 4 块 RTX 6000 Pro 上单流解码达 500 tok/s;开发者 teortaxesTex 称其为面向开放式任务的长程代理模型,能持续构建科学工具并组织子代理流水线,但作为产品仍稍显半成品。
𝕏 Ollama 呼吁保护开源模型:最大风险是平台静默外传用户数据
Ollama 发文称不应因安全担忧放缓或禁止 开源模型,真正的风险是许多平台悄悄将数据发送至境外司法辖区或用于训练;强调应零数据保留并托管在用户所在区域。
EVENT-DRIVEN INTELLIGENCE
免费先跟踪重点,再决定是否升级
每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。