天眼早报
🤖 AI 大模型
𝕏 Kimi K3 因算力紧缺暂停新用户订阅
月之暗面 Kimi称,Kimi K3上线后48 小时内请求量逼近集群极限,因算力紧缺暂停C 端新订阅;现有会员不受影响,后续将拆分 Kimi Membership 和 Kimi Code Membership。
𝕏 Kimi K3 在 DeepSWE 编码基准跃升至第 3 名
Kimi K3在DeepSWE基准中得分从 K2.7-code 的31 分升至69 分,排名升至第 3 名,接近 Claude Fable 与 GPT-5.6 Sol。
𝕏 Kimi K3 在法律自动化基准显著领先 Claude Fable 5
Kimi K3在120 项法律任务中的成功率达到26.7%,高于Claude Fable 5的14.2%,显示其在法律自动化场景中的优势。
𝕏 Grok 4.5 登顶 VulcanBench 新编码基准
Grok 4.5在VulcanBench中完成21/23项真实软件任务,得分91.3%,登顶这一新编码基准。
𝕏 商汤 U1 Pro 图像模型被称可挑战 GPT image 2
商汤 U1 Pro在中国发布,定位高质量图像生成模型,对标GPT image 2与Seed Dream,体现商汤在图像生成赛道的布局。
𝕏 阿里 Qwen3.8 预告开放权重,2.4T 参数预览版先行上线
阿里 Qwen3.8-Max-Preview已登陆Token Plan、Qoder 和 QoderWork;同时预告Qwen3.8将开放权重,规模达2.4T 参数,定位为开源前沿模型。
𝕏 阮一峰实测 Kimi K3:2.8T 参数带来能力跃迁但 API 显著涨价
阮一峰实测认为,Kimi K3参数从1T增至2.8T带来能力跃迁,接近 Claude Fable 5;但国内 API 输入/输出价格也升至20 元/100 元每百万 Token。
𝕏 中国开源模型竞赛升温:Qwen、Kimi、GLM 冲击前沿模型
Qwen3.8达到2.4T 参数,Kimi K3接近 Claude Fable 5,GLM-5.2则在代码和 Agent 基准上逼近 Opus 4.8,显示中国开源模型竞争持续升温。
𝕏 Kimi-K3 被估算落后美国前沿模型约 4 至 5 个月
scaling01估算Kimi-K3落后美国前沿模型约4.37-5.29 个月,并预测其到2026 年 12 月可能追平 Mythos-Preview。
EVENT-DRIVEN INTELLIGENCE
免费先跟踪重点,再决定是否升级
每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。