天眼早报
🤖 AI 大模型
𝕏 Kimi K3 开源发布,性能接近 Fable 5,多个基准测试领先
Kimi K3 开源模型发布,在 DeepSWE 基准排名第三,效果接近 Claude Fable 5 和 GPT-5.6 Sol,价格仅为 Fable 5 的 35%。在 ValsAI Vibe Code Bench 以 85.0% 位列第二,在 SpreadsheetBench 2 完成 34.8% 完整工作流排名第一,初步 ECI 达 155.53 略超 Opus 4.6。参数规模为 2.8T(Grok 4.5 仅 1.5T),每任务成本高于 Fable。在 FrontierMath Tier 4 仅 39%,落后美国最佳模型 7%。OpenAI 战略未来主管 迪恩·鲍尔 称其为非常优秀的模型,可与 2026 年 Q1 最优秀公开模型媲美。
𝕏 Google 推迟 Gemini 3.5 Pro 发布,因编码能力未达内部目标
据 @minchoi 透露,Google 原计划发布的 Gemini 3.5 Pro 因编码能力未通过内部评估而被推迟。期间业界已推出 Fable 5、GPT-5.6、Grok 4.5、Kimi K3。
𝕏 DeepSeek V4 GA 版本测试中,性能接近 Opus 4.8
消息称 DeepSeek V4(GA)正在测试,早期结果达到 Opus 4.8 水平,在 3D 和 代理行为 方面表现更优,定价预计保持不变。
𝕏 GLM 5.2 在 OpenRouter 降价 80%,性价比突出
GLM 5.2 在 OpenRouter 上价格降至 $0.2/$0.8/百万 token,性价比突出。
𝕏 Anthropic 将 Fable 5 纳入顶级订阅,额度减少 25%
Anthropic 自 7 月 20 日起将 Fable 5 纳入最高级订阅,但额度减少 25%。此前活动提升了 50% 额度,实际缩水。Pro 用户无法使用。
𝕏 Kimi 估值达 315 亿美元,创始人杨植麟或成华人最年轻千亿富翁
Kimi 最新估值达 315 亿美元,1992 年 出生的创始人 杨植麟 持股 51.83%,身家约 1106 亿人民币,或成华人史上最年轻千亿富翁。
𝕏 Google 更新 Gemma 4,大幅提升工具调用能力
Google 更新 Gemma 4,修复工具调用稳定性和一致性,预填充速度提升 25-70%。Unsloth 已发布量化版本便于本地部署。
EVENT-DRIVEN INTELLIGENCE
免费先跟踪重点,再决定是否升级
每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。