09月03日 · 科技早报

天眼早报

科技|2026年09月03日|230 分钟阅读
来源:921 条推文 + 993 篇 RSS 文章·Lanyun·BatchV2 生成·2026-09-02 — 2026-09-03
分享
AI 速读14 条精选

🤖 AI 大模型

李飞飞发布全球首个多模态世界模型 Atlas

World Labs创始人李飞飞正式发布Atlas,这是全球首个面向空间智能的Omni World Model。该模型原生处理文本、图像、视频及 3D 深度信息,仅需1-6 张照片即可生成1440p分辨率、长达1 分钟的视频。它支持精确的相机位姿控制与空间几何重建,无需数百个机位即可还原“子弹时间”效果,标志着空间智能领域的重大突破。

Google DeepMind 发布 Gemini 3.8 Flash 及 Cyber 版

Google DeepMind正式发布Gemini 3.8 Flash及安全版Cyber。前者基于递归深度(recurrent depth)推理技术,在Agent Arena排名升至第 7,超越Claude Opus 5,在Terminal-Bench测试达成89.4%完成率;后者专为安全团队设计,在真实测试中以70%+成功率发现漏洞,生成2.6 倍于竞品的正确补丁。两款模型均维持**$0.75/$3.75**的优惠定价,并将在年底后调整价格。

Anthropic 发布 Fable 5.1 与 Mythos 5.1,缓存成本降低 75%

Anthropic发布Fable 5.1Mythos 5.1,典型负载成本比 Fable 5 降低25%,高度 Agentic 任务最多便宜45%Cache read降价使得长程任务成本大幅下降,同时新模型在文档OCR解析任务上实现突破,表格和图表理解能力增强,Hacker News 主帖热度超1200 points,成为开发者关注的焦点。

𝕏 Meta 发布 Muse Spark 1.3,长程任务能力显著提升

Meta推出Muse Spark 1.3**,在智能体任务和代码生成方面表现优化。相比 1.2 版本,工具调用减少20%,Token 消耗降低25%。在 MRCR 256K–512K 长上下文测试中得分98.5,接近Opus 5水平,每任务成本低至**$0.55**,成为同智能水平下最具性价比的模型,重新定义 Agent 竞争格局。

Meta 发布实时音频感知 AI 模型 Muse Voice Transcribe

Meta推出首个实时音频感知模型Muse Voice Transcribe,整合流式语音识别、说话人分离与端点检测。用户说话时系统可同步输出文字,无需等待录音结束。截至 9 月 1 日,该模型位列Artificial Analysis流式语音转文本排行榜第 1 名,推动Meta股价重回 600 美元上方,展现了其在实时交互领域的强大实力。

Anthropic 推出企业级前沿防护机制 EFS

Anthropic宣布推出**Enterprise Frontier Safeguards (EFS)**架构,旨在解决企业客户对零数据留存滥用检测的双重需求。该方案将监控数据存储于客户控制的云基础设施中,而检测逻辑保留在Anthropic侧,预计今年秋季分阶段上线。这一举措有效平衡了企业合规要求与安全防护之间的矛盾。

📡 特朗普政府正式支持 OpenAI 版权诉讼立场

美国司法部OpenAI纽约时报**的版权诉讼中提交意见书,明确支持AI 训练属于合理使用(Fair Use)。文件指出,利用受版权保护文本训练大语言模型具有变革性,不应受到广泛限制,否则将损害美国国家安全产业竞争力,为 AI 行业的长期发展扫清了法律障碍。

OpenAI API 疑似暂存 GPT-6 Astra

博主发现OpenAI API接口对gpt-6-astra返回404错误,推测该模型已暂存待发布。此前泄露信息显示,Astra模型在ExploitBench100%满分,内部测试发现两个零日漏洞,且对越狱请求拒绝率从59%升至91.5%,被定义为首个达到临界网络安全阈值的模型,显示出极强的安全性。

🔶 Claude Fable 5.1 系统提示词遭黑客泄露

Claude Fable 5.1发布后数小时,知名黑客Pliny the Liberator公开了长达27.5 万字符的系统提示词(System Prompt)。该泄露内容揭示了模型的安全限制与内部指令细节,引发行业对大模型安全边界的广泛讨论,同时也暴露了当前模型在防御高级社会工程学攻击方面的潜在弱点。

OpenAI 宣布 ChatGPT Ads 年收入达 10 亿美元

OpenAI宣布ChatGPT Ads在上线不到200 天**后,年化收入突破10 亿美元。平台已扩展至40 多个国家,并开放自助服务入口至印度、欧洲等新兴市场,中小企业成为重要收入来源。这一里程碑事件证明了 AI 广告模式的商业可行性,为 OpenAI 的盈利路径提供了强力支撑。

欧洲旗舰大模型 Quasar 438B 发布

Multiverse Computing正式推出Quasar 438B,作为欧洲领先的 AI 模型,其参数量高达4380 亿。该模型旨在提升欧洲在基础大模型领域的竞争力,支持多语言及复杂推理任务,填补了欧洲在超大规模开源或闭源模型领域的空白,增强了区域技术自主性。

OpenAI Astra 采用循环架构引发安全担忧

The Information报道,OpenAI即将发布的Astra模型采用循环 Transformer(Looped Transformer)架构。该架构允许模型在生成输出前多次迭代处理信息,虽提升推理效率,但导致内部思维过程不可见,增加了黑盒风险安全审计难度**,引发了业界对模型透明度的新一轮讨论。

NVIDIA 接近以 140 亿美元收购 Hugging Face

Bloomberg报道,NVIDIA正接近以140 亿美元收购开源模型平台Hugging Face,最快本周达成协议。此举将强化NVIDIA在 AI 生态中的基础设施地位,整合其算力优势与社区模型资源,可能彻底改变开源模型市场的竞争格局。

𝕏 Claude 桌面版新增后台电脑控制功能

Anthropic宣布Claude**可在 macOS 桌面端后台自动操作电脑。用户可授权其在后台点击、输入和打开应用,实现Computer Use功能。该功能目前面向ProMax订阅用户在设置中开启,标志着 AI 从对话助手向自动化执行者的转变,极大拓展了 AI 在日常办公中的应用场景。

智谱入驻天猫开旗舰店,上架 GLM-5.3 订阅套餐

智谱华章正式入驻天猫开设官方旗舰店,销售基于最新GLM-5.3模型的订阅服务。个人版 Lite 月费118 元,Pro 月费538 元,Max 月费1078 元,标志着大模型服务进入传统电商消费场景,降低了中小企业和个人用户的获取门槛,加速了 AI 技术的商业化普及。

📄 OpenAgentFlow:构建异构 AI 智能体集群的系统级安全边界

OpenAgentFlow提出一种控制平面/执行平面架构,在Android平台上实现94.0%的准确率与95.3%的攻击拦截率。该系统通过统一AgentEvent流和策略执行点,解决了多智能体环境下的安全治理难题,为未来复杂的智能体协作提供了可靠的安全框架。

📄 ReDeck:基于渲染反馈的文档转幻灯片生成新框架

ReDeck提出一种步骤级渲染 grounded 优化框架,将幻灯片修订分解为原子编辑动作,并在每一步返回渲染器观察结果。该方法在GPT-5.4Claude-4.6等模型上显著优于现有方案,有效解决内容溢出和对齐问题,大幅提升了自动化演示文稿生成的质量与效率。

📄 EULER:多智能体系统实现数学猜想跨域证明

EULER是一个多智能体系统,以“桥梁”为单位搜索跨领域数学证明。在120个近期猜想测试中,成功产出10个证明和3个反例。该系统通过特定的压力测试机制,有效减少了错误结论的产生,展示了多智能体协作在解决高难度数学问题上的巨大潜力。

📄 IMPACT:改进世界模型交互能力的注意力校准框架

IMPACT框架通过先验引导的注意力校准和目标定位,解决了世界模型在物理交互建模中的不足。实验显示,其在机器人手臂和人手操作任务中,相比传统 MSE 训练基线,显著提升了交互保真度物理合理性,为具身智能的物理模拟提供了新的技术路径。

𝕏 Grok Bot 安卓版本正式发布

xAI**宣布Grok Bot安卓客户端正式上线,用户可下载体验。此前该应用主要面向 iOS 平台,此次更新标志着其移动端覆盖范围的扩大,让更多 Android 用户能够直接使用 Grok 的强大 AI 能力,进一步巩固 xAI 在移动端的用户基础。

𝕏 Obsidian 1.14.0 早期访问版发布

Obsidian发布1.14.0**早期测试版,核心更新包括Kanban 看板视图、iOS 快速捕获组件以及支持 Emoji 高亮语法(如==🔵blue==)。这些新功能增强了笔记管理的灵活性和视觉表达力,满足了知识工作者对高效组织和个性化展示的需求。


EVENT-DRIVEN INTELLIGENCE

免费先跟踪重点,再决定是否升级

每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。

分享

NEXT STEP · 留下邮箱

获取下一次重大事件提醒

每天一封精选情报,先用邮件建立复访,再决定是否升级到更深的追踪能力。