天眼早报
🤖 AI 大模型
🔵 英伟达以 60 亿美元获得 AI 初创 Poolside 模型许可
英伟达同意支付60 亿美元,获得Poolside公司 AI 模型使用许可,并向其100 多名员工发出录用通知。这是 AI 领域又一笔巨额模型授权交易。
𝕏 Grok 4.6 登顶 CursorBench,单任务成本仅 0.84 美元
xAI 发布 Grok 4.6,在 extra high thinking 模式下登顶 CursorBench,已上线 Vertex AI 与 Cursor。ARK 引用 Artificial Analysis 数据称,其单任务成本仅 0.84 美元,性能和成本均处于帕累托前沿。
𝕏 OpenAI 下调 GPT-5.6 Sol API 价格超 20%
OpenAI 将 GPT-5.6 Sol API 价格下调 20% 以上,持续 3 个月,并新增按密钥追踪用量功能。
𝕏 TARS 发布具身智能基础模型 AWE 3.5
TARS 发布 AWE 3.5 具身智能基础模型,融合视觉与动作,效率为 PI0.5 的 2 倍。
🔵 Anthropic 挖走谷歌 TPU 之父 Amir Salek
Anthropic 聘请谷歌 TPU 之父 Amir Salek,他曾参与推出前 七代 TPU,这是 Anthropic 布局自研硬件的重要一步。
神秘模型 Ox Alpha 技术特征指向智谱,编程基准超越 GPT-5.6 与 Claude
独立工具 ModelPrint 确认神秘模型 Ox Alpha 为 智谱 GLM 新模型;其在部分编程基准中超越 GPT-5.6 与 Claude Opus 5,OpenRouter 可免费使用,多模态 Agent 能力接近前沿。
DeepSeek 发布实验性视觉理解模型 V4-Flash-Vision-Exp
DeepSeek 上线 V4-Flash-Vision-Exp,提升多模态 Agent 表现,视觉 Agent 基准接近 Opus-4.8,并同步推出 Files API。同一消息源还提到,Ox Alpha 支持 100 万 token 上下文,接受文本、图像、视频输入,在编码与 Agent 任务中表现出色。
𝕏 Claude Security 扫描升级至 Mythos 5,开放企业公测
Anthropic 宣布,Claude Security 的代码漏洞扫描由 Mythos 5 驱动,即日对 Claude Enterprise 客户开放公测。
𝕏 Gemini 3.1 Flash Live 登顶语音智能体竞技场
Gemini 3.1 Flash Live 在 Artificial Analysis Speech Agent Arena 中排名第一,在人类偏好测试中表现最佳。
𝕏 AlephProver 在 ProofBench 追平 Claude Opus 5
Logical Intelligence 的 AlephProver 在 ProofBench v1.1 上与 Claude Opus 5 并列第一,但成本高 5 倍。
𝕏 Harvey 发布法律专用模型 Tenet,基于 Kimi K3
Harvey 发布 Tenet——基于 Kimi K3 后训练的法律 AI 模型,在 LAB Contracts 基准上达到 SOTA,全部通过率较基座提升 82%,运行成本低于领先基础模型的四分之一。
𝕏 SenseNova-U1.5-8B-MoT 开源,图像生成媲美 Nano Banana 2
SenseNova-U1.5-8B-MoT 开放权重,架构上不用 VAE/文本编码器/DiT,采用混合 Transformer在像素空间去噪,基准匹配 Nano Banana 2。
EVENT-DRIVEN INTELLIGENCE
免费先跟踪重点,再决定是否升级
每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。