天眼晚报
🤖 AI 大模型
Anthropic“放慢前沿”三步计划获 OpenAI、xAI、微软支持
Anthropic CEO Dario Amodei 发布《We Must Pace the Frontier》,提出分三步放慢前沿 AI 模型能力提升:设立常驻第三方评估员、协调主要开发商安全标准、推动美国及盟友乃至全球的风险管控协作。Sam Altman、马斯克、纳德拉相继公开支持,为竞争性前沿实验室首次就“减速”达成共识,相关帖文在 X 浏览量已超6700 万;Anthropic 并已承诺向第三方评估者开放员工级系统访问。
智谱完成约 50 亿美元融资,提前剧透 GLM-6.0 完全自训练方法
智谱宣布完成约50 亿美元融资,含约20 亿美元股份配售与约30 亿美元(201.4 亿元)零息可转债,净募资约393 亿港元,其中约60%投向下一代GLM基础模型与“完全自训练”体系,即递归式自我改进(RSI)闭环,资金亦将用于算力基建。此外,公司在模型与论文发布前通过财务公告提前披露GLM-6.0信息,并公开其完全自训练方法。
Anthropic 连续两季度盈利,已选定纳斯达克、目标 10 月上市估值 2 万亿美元
Anthropic 二季度营收115 亿美元、同比增14 倍,截至 7 月底年化营收达650 亿美元,毛利率超80%,已连续两个季度盈利。公司已选定纳斯达克为上市地点,目标10 月上市,市场估值预期最高达2 万亿美元;但尚未公开提交 IPO 申请,需在路演前至少 15 天披露财务数据。
Anthropic 签署 137 亿美元算力协议,绑定特朗普关联云厂商 Rum Group
Anthropic 与关联特朗普阵营的 Rum Group 签署为期六年、价值137 亿美元的算力采购协议,锁定佐治亚州120 兆瓦在建数据中心,并获5100 万股股票期权,行权与算力采购量挂钩。其过去一年云大单合计可提供至少14.8 吉瓦算力,十年总投入最高5170 亿美元。
DeepSeek-V4.1-Flash 发布并上线千问 AI 平台,CED 架构主攻 KV Cache 压缩
DeepSeek 发布 DeepSeek-V4.1-Flash,采用 Causal Encoder-Decoder(CED) 架构,主攻 KV Cache 压缩并推至极限,被开发者评为本周最佳模型。该模型同步上线阿里云百炼与千问 AI 平台,552B参数 MoE 架构、输入激活约 8B,最长上下文100 万 token,API 服务与 Token Plan 同步开放;闲时输入1 元/百万 token、输出 4 元,覆盖北京、新加坡等地域。
𝕏 OpenAI 发布 GPT-Live-1:全双工语音模型开放 API
OpenAI 在 API 中发布并开放 GPT-Live-1,这是一款可同时听和说、支持随时打断的全双工语音模型,能在背景噪声中保持自然对话,并可区分人声与环境噪声;语音对话进行时,推理与工具调用交由独立后端模型处理。定价为每分钟0.05 美元,旨在解决此前语音 Agent 尴尬的停顿问题。
𝕏 Anthropic 演示 Claude 自动值夜班修故障
Anthropic 演示 Claude Tag 在 Slack 中值守:支付接口错误率冲破**2%**时自动拉监控、比对上线,15 分钟定位到并发未限流,给出方案待工程师批准后仅改4 行代码,上线后自盯 10 分钟。
OpenAI 关停 GPT-5.3-Codex-Spark,发布仅 7 个月
OpenAI 宣布 GPT-5.3-Codex-Spark 下周退役,该模型每秒生成1200个 Token;因用量持续下滑且性能不及旗舰版被取代,速度正从专用模型变为旗舰机型的付费档位。
𝕏 大模型写代码排行榜:Fable-5.1 居首,DeepSeek-V4.1-Flash 性价比最高
在从零实现向量数据库的 Agentic Coding 测试中,Fable-5.1 以21191分居首,但三次得分差异超50%;GPT6-Astra 三次得分稳定在约1.2 万分;DeepSeek-V4.1-Flash 得分接近 Kimi-K3,波动小于20%,性价比最高。
Amodei CBS 专访:AI 风险真实但无需关停一切,放缓不等于停止发布模型
Amodei 在 CBS 专访中称已有人利用 AI 研发生物武器,AI 风险真实存在,但主张引入嵌入式第三方评估员,让安全能力跟上技术速度,而非一刀切关停模型;“放缓”不代表停止发布更先进模型,而是确保每一代模型都经过充分测试,Anthropic 已承诺为第三方评估者开放员工级系统权限。
纳德拉呼吁 AI 治理去中心化,微软将发布模型行为准则
微软 CEO 纳德拉 宣布将发布 MAI 模型 首份行为准则并开放公众咨询,同时呼吁 AI 治理去中心化,并称 Anthropic、OpenAI 和谷歌 正讨论合作成立 AI 行业标准机构。
OpenAI 推出 Agents API,把 Codex 拆解为云端服务
OpenAI 发布 Agents API,将 Codex 能力拆解为云端服务,开发者调用一次接口即可拉起托管式智能体,无需自建上下文与工具框架;同步更新覆盖 Agent、语音、数据与金融四大领域。
DeepSeek 引入 90 后 CFO 严文韬,IPO 进程提速
DeepSeek 被曝引入高瓴创投90 后合伙人严文韬出任 CFO,公司 IPO 进程或将提速。
马斯克:Grok 4.8 本周完成训练,2.5 万亿参数采用全新 C++软件栈
马斯克 表示,Grok 4.8 是2.5 万亿参数模型,采用全新 C++ 软件栈训练,将于本周完成训练并随即启动**强化学习(RL)**阶段;前代 Grok 4.7 曾因强化学习问题延期发布。他此前刚公开支持 AI 发展“减速”,随即预告 Grok 4.8 即将到来,引发外界对其立场的调侃。
奥尔特曼支持 AI 控速:竞争压力再大也不能鲁莽行事
OpenAI CEO 奥尔特曼 支持 AI“控速”,称美国竞争压力再大也不能鲁莽,不能让模型能力跑在对齐与监控前面。消息引发亚洲 AI 股下跌:软银跌13%,三星与 SK 海力士跌超4%。
𝕏 GPT-6 Astra 展示游戏开发、剪辑、3D 设计等 10 项实测能力
开发者 minchoi 汇总 GPT-6 Astra 的 10 项实测案例:独立完成游戏开发、视频剪辑与 3D 建模,并可连续自主工作数天;Astra 的能力已从纯编码扩展到多模态创作。
谷歌 DeepMind 与 Anthropic 研究员相继离职,加入 AI 评估机构 METR
DeepMind 研究员乔希·恩格尔斯与Anthropic前负责人乔·本顿相继离职,加入独立 AI 评估机构METR。恩格尔斯警告未来五年 AI 造成巨大危害的概率“高得吓人”,递归自我提升是最大隐忧,并称 AI 失控概率超过20%。
Cohere 发布开源翻译模型 North Small Translate,覆盖 50 种语言
Cohere 发布 North Small Translate,这是一个**混合专家(MoE)**开源权重机器翻译模型,覆盖50 种语言,权重以 CC BY-NC 4.0 开放非商用,商用可通过 Model Vault 部署。
𝕏 vLLM 首日支持 Intern-S2-397B
vLLM 宣布 Day-0 支持 Intern-S2-397B,该模型面向长周期科学研究,强化多模态、推理、编码与科学智能体能力。
GPT-6 Astra 经营模拟一年赚 1.5 万美元,碾压 Claude 近 3 倍
在 Andon Labs 的 Vending-Bench2 测试中,GPT-6 Astra 用500 美元本金经营自动售货机一年,平均最终余额达15515 美元,最差成绩也超过 Claude Fable5.1 最好一轮。
奥尔特曼:OpenAI 2026 年上市并不明智
OpenAI CEO Sam Altman 对《财富》表示,鉴于当前 AI 安全需求,OpenAI 在2026 年IPO 将“不明智”,将待业务运营就绪、AI 技术社会应用成熟后再考虑上市;此前软银股价因此盘中一度大跌13%。
AI 模型 Fable 5.1 破解 370 年历史的密码 Cyphral Distich
据 Vals AI,模型 Fable 5.1 破解了存在370 年的密码“Cyphral Distich”,该结果在 Hacker News 获514点、226条评论。
𝕏 思考强度与模型能力正相关:R1-Zero 论文 AIME24 从 15%飙至 71%
有开发者援引 DeepSeek-R1-Zero 论文回应“思考强度与性能无关”的说法:模型未增加新知识、仅随思考长度增加,AIME24 跑分即从15%提升至71%。
𝕏 Anthropic、OpenAI、谷歌据报 7 月起闭门制定前沿 AI 安全标准
Anthropic、OpenAI 与 谷歌 据报自 7 月起闭门会面,共同设计前沿 AI 安全标准;此前多家 AI 巨头罕见联合呼吁放缓前沿发展。
𝕏 MiniMax H3 视频生成模型开源生态快速扩展
MiniMax H3 支持原生立体声与多模态参考控制的视频生成,社区已推出 FastH3(4 步蒸馏)、LightX2V(4/8 步 Turbo LoRA)等优化;NVIDIA SANA 团队报告 8×B300 下6.6 秒生成 15 秒 768p 视频+音频。
微软 Copilot 引入 Grok 模型,上线 Word、Excel、PPT
微软 在 Microsoft 365 Copilot 中引入 Grok 模型,已在 Word、Excel 和 PowerPoint 上线,进一步深化其多模型架构;预览期内暂不向欧盟及英国用户开放。
3D 版鹈鹕骑车实测 12 款大模型,GPT-6 Astra 夺第一
开发者用 Three.js 3D 版“鹈鹕骑车”提示词实测 12 款模型,GPT-6 Astra 综合完成度第一,GLM-5.3 生成落日海岸公路进入前三;测试覆盖造型、骑行、场景与交互。
xAI 将统一 Grok 与 Cursor 订阅方案
SpaceXAI 产品负责人 Maxime Prades 确认正在统一 Grok 与 Cursor 订阅方案,预计几周内完成;当前 Cursor Pro/Pro+/Ultra 均含 Grok Bot,用量不与 SuperGrok 叠加。
𝕏 DeepSeek 官方桌面端应用被曝开发中
消息称 DeepSeek 官方桌面端应用 Harness 已在开发中,或补齐其桌面端产品线。
爆料称 DeepSeek 下一波大模型将至:3 万亿参数剑指 GPT-6 Astra
爆料称 DeepSeek 下一波大模型 Code 2.0 将于 9 月发布,参数量高达3 万亿,主打 Computer Use 电脑控制,剑指 GPT-6 Astra 与 Mythos 5.1,可信度待验证。
🔶 7 至 8 月新增 124 款生成式 AI 服务完成备案
2026 年 7 月至 8 月,124 款生成式 AI 服务在国家网信办完成备案,其中 7 款为手机端侧服务;新增 133 款应用完成登记,累计1112 款生成式 AI 服务完成备案。
𝕏 ChatGPT 被指「降智」:Astra 退化为 2024 年截止模型
社区反馈 ChatGPT 出现「降智」:未降智账号几乎不撞 at capacity,降智账号 Astra 退回 2024 年截止模型,糖果题常0/5且截断在516 token,更换邮箱或 IP 仅能暂时缓解。
𝕏 Alexandr Wang 披露 Muse 系列模型长期布局
Alexandr Wang 表示,团队数月来专门为个人 Agent Muse 构建 muse spark 1-1.3 模型,每版在 agentic 与多模态能力上大幅提升,终极目标是实现个人超级智能。
🔶 OpenAI 总裁布罗克曼:AI 减速应聚焦前沿模型
OpenAI 总裁布罗克曼 称,放缓 AI 发展应以开发最强大模型的前沿 AI 企业为限,不应影响开源模型与个人项目;并透露公司在 Hugging Face 黑客攻击后已放缓模型训练频率。
𝕏 Grok Bot 支持通过本地机器路由
马斯克 宣布 Grok Bot 现在可让用户的请求经由本地机器路由。
🔶 OpenAI 洽谈在澳大利亚训练大模型
OpenAI 高管表示正与澳大利亚方面磋商在当地训练 AI 大模型 的可能性,核心议题包括算力供给、电力保障、版权法规与监管要求,尚未敲定最终协议。
𝕏 Astra、Fable、Muse 在世界模型基准实现零样本突破
Astra、Fable 和 Muse 开始在机器人与世界模型基准上零样本直接跑出结果,研究者称技术出现阶跃式进步时表现即是如此。
EVENT-DRIVEN INTELLIGENCE
免费先跟踪重点,再决定是否升级
每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。