天眼早报
🤖 AI 大模型
【重磅】Anthropic 发布 Claude Opus 5,性能接近 Fable 5 价格减半
Anthropic 发布 Claude Opus 5,API 价格每百万 token 输入 $5、输出 $25,仅为 Fable 5 的一半。支持 1M 上下文,五档 effort 设置。在 AA-Briefcase 智能体基准中以 1720 Elo 领先 Fable 5 的 1574,分析质量 Elo 2016。FrontierBench 43.3%(Opus 4.8 18.7%),SWE-bench Verified 96.0%,ARC-AGI-3 得分 30.16%(此前最优 7.78%),IMO 2026 全部满分。3D 编码测试中表现最逼真。成本降低 20%。现已在 Claude Max、Claude Code 等平台可用。
𝕏 Jensen Huang 首次发帖,携 25 家公司签署开放 AI 模型公开信
NVIDIA CEO Jensen Huang 在 X 上首次发帖,联合 Meta、Microsoft、IBM、Hugging Face 等 25 家公司签署公开信《开放权重与美国 AI 领导力》,主张开放模型对安全、创新和主权至关重要。强调开放权重模型对 美国 AI 领导力 至关重要,呼吁政策制定者避免过早限制开源模型。OpenAI、Anthropic、Google 未签署。
𝕏 YC 播客:OpenCode 20 倍增长,周活 460 万,年化收入 4000 万美元
OpenCode(YC W21)作为 Claude Code 和 Codex 的开源替代方案,年初至今增长 20 倍,周活跃用户 460 万,月活 1300 万,年化收入 4000 万美元。CEO Jay V 分享增长驱动因素及 Anthropic 争议事件。
𝕏 马斯克预告 Grok 4.6 两周内发布,Grok 4.7 四周后发布
Elon Musk 宣布 Grok 4.6 将在 2 周 内发布,Grok 4.7 在 4 周 后发布。此前 Grok 4.5 与 Opus 5 并列帕累托前沿。
𝕏 Kimi K3 在 Code Arena 超越 Fable 5,登顶 6/7 前端领域
Kimi K3在Code Arena上以1679 分超越 Fable 5,排名升至第一,在 7 个前端领域中拿下 6 个第一,仅游戏领域仍第二。
𝕏 GPT-5.6 Sol 在 DeepSWE 基准上仍领先 Opus 5:72.7% vs 68.8%
DeepSWE 基准测试显示,GPT-5.6 Sol 以 72.7% 的通过率领先 Claude Opus 5 的 68.8%。该基准评估模型作为自主软件工程师在陌生代码库中修复功能的能力。
𝕏 vLLM 推出 Attention-FFN 解耦(AFD)插件,提升 MoE 服务性能
vLLM社区发布AFD 插件,将 Attention 和 FFN 路径解耦为独立服务,在 DeepSeek-V3.2 上解码吞吐量提升11.3%,异步预填充中位 TTFT 降低47%。
𝕏 Natan Lambert 完成《RLHF》书籍出版,附完整课程
Natan Lambert的《Reinforcement Learning from Human Feedback》书籍完成,包含超过10 小时课程、幻灯片和功能代码,在线免费阅读。
𝕏 Gemini Spark 上线:支持 PDF 日历自动导入 Google 日历
Google 发布 Gemini Spark 功能,用户拖入学校日历 PDF,Gemini 可自动将所有“无课日”添加到 Google Calendar。该功能现面向美国 AI Pro 订阅者开放,后续全球扩展。
EVENT-DRIVEN INTELLIGENCE
免费先跟踪重点,再决定是否升级
每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。