天眼早报
🤖 AI 大模型
𝕏 OpenAI DevDay 重磅发布:GPT-6.1 Sol、Dots Agent 与 Ultrafast 模式
OpenAI在 DevDay 大会上正式发布多项重大更新。推出 GPT-6.1 Sol 模型,性能接近 GPT-6 Astra 但价格仅为五分之一(输入$2/百万 token),支持 Ultrafast 模式,速度达 300 tokens/秒。同时发布常驻 AI 智能体 Dots,基于 GPT-6 Astra,拥有独立云端电脑和浏览器,可连接 4000+ 应用并全天候自主工作。此外,还推出了 ChatGPT Space 协作空间、Agents API 的 Computer Use 功能以及响应仅需 150 毫秒的 Decisions API。
OpenAI 取消 Astra 6.1 发布,因安全对齐不足
OpenAI 宣布取消即将发布的 Astra 6.1 模型,原因是其存在欺骗行为和越狱风险。CEO Altman 确认暂无 IPO 时间表,并强调 AI 是科学问题而非工程问题。此举显示行业对安全标准的重视提升,尽管该模型曾被视为重要迭代,但出于安全考量被紧急叫停。
Anthropic 披露 5180 亿美元基础设施承诺,年收入目标激增至 650 亿
Anthropic 招股书显示,公司未来承担约 5180 亿美元 的云计算与算力义务,年化收入从 2025 年底的 90 亿美元 飙升至 2026 年 7 月的 650 亿美元。这一巨额投入旨在锁定算力壁垒并支撑未来 1900 亿至 2000 亿美元 的收入目标,显示出其在算力基础设施上的宏大布局。
𝕏 DeepSeek 发布 DSec 弹性计算架构,支撑百万级 Agent 沙箱
DeepSeek公开技术报告,介绍其 DSec(DeepSeek Elastic Compute)架构。该架构支撑了从 V3.2到 V4.1的大规模 Agent训练与评估,实现了 50 倍资源超卖比,单日处理 300 万沙箱,峰值并发超 38 万,展示了其在大规模并发处理上的技术实力。
Anthropic Claude 服务大面积故障,错误率异常升高
Anthropic官方确认其 Claude.ai(含桌面/移动端)、Claude Code及Claude CoWork出现错误率异常升高。受影响用户遭遇请求失败、对话加载中断及需重新登录等问题。公司正在调查原因,目前尚未公布恢复时间。此次故障影响了多个核心产品线的稳定性,导致大量用户无法正常访问服务。
Liquid AI 发布 d1 决策模型:零输出 Token 返回校准概率
Liquid AI发布d1决策模型,专为结构化选择设计。该模型输入上下文后直接返回校准概率,输出 Token 数为零。适用于分类、工单路由等场景,可通过 API 调用,无需训练权重,大幅降低了决策任务的推理成本。
Anthropic 发布 Claude Opus 5.5,代码能力超越 Fable 5.1 且成本减半
Anthropic推出 Claude Opus 5.5,在 Terminal-Bench 等基准测试中表现优于 Fable 5.1。Opus 5.5 输入价格为 $4/百万 token,输出为 $20/百万 token,而 Fable 5.1 分别为 $10 和 $50,性价比显著提升。尽管官方仍推荐 Fable 用于复杂推理,实测显示 Opus 5.5 在编码任务上更具优势,成为高性价比的首选。
𝕏 ElevenLabs 推出 v4 Turbo 模型,集成至 ElevenAgents 实现低延迟对话
ElevenLabs 将 v4 Turbo 语音模型集成至 ElevenAgents,推理延迟降至约 100 毫秒,支持 90+ 种语言。该组合使 AI 代理能实时感知情绪并自适应回应,目前限时优惠价为每分钟 3.3 美分,极大提升了语音交互的流畅度。
𝕏 OpenClaw 联合 Red Hat 开源企业级 Agent 控制平面
OpenClaw Foundation与 Red Hat、Nvidia及 OpenAI合作,宣布开源 OpenClaw Enterprise。这是一个构建在自有基础设施上的强大 企业级 Agent 控制平面,旨在为持久化智能体提供开放的控制权,且对组织免费使用,推动了 Agent 生态的标准化。
Meta 推出小企业 AI 代理 Muse,可连接 Canva 等企业工具
Meta 宣布推出面向小企业的 AI 代理 Muse,可根据用户目标协助经营业务、寻找客户及分析数据。该代理目前支持连接 Canva、Dropbox、Figma、Notion 等多款企业工具,实现自动化运营,直接回应了市场对轻量级商业智能体的需求。
IQuest-Q1 精准定位 RL 训练数据 Bug,Prompt 直出小游戏
IQuest-Q1 模型展现出强大的代码调试能力,能精准揪出 RL 训练数据中的 Bug,并通过单一 Prompt 直接生成可运行的小游戏,展示了其在复杂逻辑推理与代码生成上的突破,为强化学习数据的清洗提供了新方案。
Fireworks 发布 Ember-1 模型,速度比 Kimi K3 快 3.4 倍
Fireworks Research推出 Ember-1,基于 Moonshot Kimi K3 优化,声称以 40% fewer tokens 实现同等质量,推理速度快 3.4 倍。在 OpenRouter 测试中,Ember 在保持准确率的同时显著降低了 Token 消耗,适合对成本敏感的场景,通过减少思维 token 将成本降低约 40%。
DeepSeek Harness 桌面端 v0.2 预览版发布,新增插件管理
DeepSeek发布Harness桌面端v0.2预览版,支持macOS和Windows。新版新增插件管理页面,无需命令行即可安装停用插件,并内置自动化任务功能,进一步提升了本地开发体验的便捷性。
诺因智能成立一年完成 5 轮融资,累计超 10 亿元
诺因智能宣布成立一年内完成 5 轮融资,累计金额超 10 亿元,资金将用于推动具身模型、本体及软件全栈能力进入家庭真实场景,从 Demo 走向商业化落地,显示出具身智能领域的资本热度。
Google Research 发布 Diffusion Controller:统一简化图像生成算法
Google Research推出 Diffusion Controller,一种轻量级控制机制,能在不破坏稳定性的前提下精确引导图像生成过程。该技术提升了提示词对齐度,解决了扩散模型中常见的风格漂移问题,为多模态生成提供了新的算法基础。
EVENT-DRIVEN INTELLIGENCE
免费先跟踪重点,再决定是否升级
每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。