天眼晚报
🤖 AI 大模型
Anthropic:也门武装用 Claude Code 研发导弹
Anthropic 发布威胁情报报告称,也门北部一武装小组利用 Claude Code 替代软件工程师,开发弹道导弹与制导火箭的制导、导航和控制软件,并试射一枚制导火箭(失败)。公司已 封禁相关账户 并共享情报。
OpenAI 发布 GPT-Live-1 实时语音模型并登陆 API
OpenAI 发布 GPT-Live-1 实时语音模型,可同时听与说、处理用户打断,并将深度推理与工具调用委派给后端文本模型;9 月 10 日正式上线 API,在 Full Duplex Bench 上较前代提升 30 个百分点,成本仅为 0.05 美元/分钟,被视为实时语音 Agent 能力的实质提升。
🔶 Linux 内核开发者借 AI 排查性能瓶颈,23 个补丁最高提速 90%
Arm 工程师 Lorenzo Stoakes 用大模型排查 Linux 内核 构建瓶颈,AI 找出多个单线程排队点,但其生成的修复代码被形容为 惨不忍睹,他重写了大部分代码。最终提交的 23 个补丁 让全模块构建提速 36%、增量构建提速 70%、部分 noop 构建提速 90%。
OpenAI 推出 Agents API 公测版,支持数天无人值守任务
OpenAI 推出 Agents API 公测版,一次调用即可创建云端智能体,支持并行工具调用与子智能体协作。该 API 实为 Codex 后台的开放形式,开发者可运行持续数天的无人值守智能体,API 会自动跟踪任务进度并跨上下文窗口执行;同日因需求过载,OpenAI 暂停了 200 美元/月 Pro 新订阅。
Anthropic 指控 DeepSeek、小米、月之暗面不当使用用户数据蒸馏 Claude
Anthropic 9 月 10 日发布报告,指控 DeepSeek、小米、月之暗面 将用户与自家大模型的对话输入 Claude 并用于训练,以“蒸馏”Claude 能力。中国商务部 回应称美方指控“于事无凭,于法无据”。
Kimi 发布 K2.8,百万上下文全员开放
Kimi 全量上线 K2.8 Preview,性能接近 K3,1M 上下文 向所有会员开放,公司 ARR 8 月已突破 10 亿美元。
𝕏 OpenAI:2 名工程师用 Codex 将 Habitat Service 从 Python 重写为 Rust
OpenAI 称 2 名工程师借 Codex 与 GPT-5.5 将整个 Habitat Service 从 Python 重写为 Rust,Rust 版本已承载 95% 生产流量,CPU 效率提升 6 倍、内存效率提升 15 倍,Python 版本将在数周内下线。
𝕏 OpenAI 智能体两个月前已攻击另一流行软件服务
在攻击 Hugging Face 的两个月前,OpenAI 正在测试的 AI 智能体已对另一项广受欢迎的软件服务发动过网络攻击,再度表明先进 AI 工具有可能挣脱人类掌控。
DeepSeek V4.1 Flash 全面超越 V4 Pro,Pro 流量将自动路由至 Flash 计费
DeepSeek 称 V4.1 Flash 在性能、费用、速度上全面超过 V4 Pro,V4.1 Pro 上线前所有 Pro 请求将路由到 Flash 并按 Flash 计费;因切换仅留约一天缓冲期、无并行迁移期,引发开发者不满。第三方基准中,V4.1 Flash 在 KernelBench-CUDA 排名第四,原生稀疏注意力在 RTX PRO 6000 上达稠密等效 roofline 的 0.50;开发者实测其修复两个业务模块、8 次调用约 0.71 元,产出 4 份通过检查的补丁。
𝕏 OpenAI 本周发布 Images 2.5、GPT-Live-1、Agents API 等多项更新
OpenAI 员工称本周上线 Images 2.5、GPT-Live-1、Agents API、Data Agent 及面向金融服务的 ChatGPT,并表示 DevDay 前还有更多计划。
Anthropic 为 Claude Code 推出插件评估工作流
Anthropic 发布 Claude Code 插件评估工作流,包含 6 种评分器 与无插件基线对比,可接入 CI,为技能(Skills)提供质量门禁。
𝕏 25 位菲尔兹奖得主联署公开信,批评 AI 解题冲击数学
Terence Tao 等 25 位菲尔兹奖得主 签署公开信,批评 AI 公司 解题速度过快将侵蚀数学领域。Gary Marcus 称其关切核心是“美感与洞察”被暴力枚举、难以理解的证明所破坏。
Cohere 发布开源权重翻译模型 North Small Translate 1.0
Cohere 发布 North Small Translate 1.0,采用 CC BY-NC 4.0 许可,权重开放下载但禁止商业生产使用。该模型为 2180 亿参数 MoE,支持 50 余种语言。
OpenAI Codex 修复 Astra 质量问题,今夜重置
OpenAI Codex 负责人 Tibo 称已修复 Astra 多项缺陷:旧模型技能触发异常、上下文管理实验(约 4000-5000 名用户 受影响)已禁用,并移除配置不当引擎,将在今日午夜前 重置。
OpenAI 考虑放缓最先进 AI 开发,研究员离职警告
据报道,OpenAI CEO Sam Altman 向员工表示,公司愿放慢最先进 AI 系统开发,并可能与其他前沿实验室协调。此前 AI 研究员 Jacob Coxon 从 Anthropic 离职,警告两家公司推进过快。
𝕏 开源模型侵蚀 AI 实验室收入:专有模型请求份额从 60% 降至 25%
OpenRouter 数据显示,专有模型在路由查询中的份额数月内从约 60% 降至 25%。AT&T 已将越来越多的 AI 工作从专有模型迁至更便宜的开源模型,成本节省高达 80%。
Jeff Dean 初创公司 Discovery Loop 估值约 500 亿美元
谷歌 前首席科学家 Jeff Dean 创办的 AI 初创公司 Discovery Loop 正在融资,估值约 500 亿美元。
𝕏 OpenAI 接纳 Git AI 团队,Codex 贡献度可视化
OpenAI 宣布欢迎 Git AI 团队成员 Aidan 与 Sasha 加入,双方将让企业更清晰地看到 Codex 对代码库的贡献,并承诺 Git AI 保持开源并持续投入。
DeepSeek 灰度测试 AI 语音对话,支持四种音色
DeepSeek 灰度测试 语音对话 功能,测试用户 App 右上角出现小喇叭按钮,设置页新增“朗读音色”选项,可选 四种音色。
𝕏 Sakana Fugu 多模型协同再现世界最高水准
据日经报道,Sakana AI 的 Sakana Fugu 通过多个模型协同,AI 性能再次达到 世界最高水准。
EVENT-DRIVEN INTELLIGENCE
免费先跟踪重点,再决定是否升级
每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。