07月21日 · 科技晚报

天眼晚报

科技|2026年07月21日|86 分钟阅读
来源:921 条推文 + 170 篇 RSS 文章·Lanyun·DeepSeek 生成·2026-07-21
分享
AI 速读16 条精选

🤖 AI 大模型

𝕏 数学家借助 Claude Fable 5 找到雅可比猜想三维反例

Levent Alpoege 借助 Claude Fable 5 找到困扰数学界 87 年雅可比猜想 三维反例。该反例仅由三行多项式公式构成,已通过多方独立符号计算验证,显示前沿模型开始在理论数学研究中提供可验证的关键突破。

𝕏 Anthropic 15 亿美元版权和解获批,焦点在盗版书籍来源

Anthropic15 亿美元 版权和解获法院批准,解决作者集体诉讼。案件核心并非单纯否定 AI 训练行为,而是法院认定其从盗版网站获取书籍的渠道存在违法问题,成为生成式 AI 训练数据版权争议中的重要案例。

𝕏 多个前沿模型在 IMO 2026 六题测试中取得满分

Fable 5GPT 5.6 SolKimi K3Axiom Math 在 IMO 2026 六题测试中均获 42/42。其中 Fable 和 Sol 用时低于 4 小时,Axiom 给出 Lean 证明,显示前沿模型在竞赛数学和形式化证明方向同步推进。

𝕏 Kimi K3 登顶前端代码竞技场,超越 Claude Fable 5

Arena.ai 评测显示,Kimi K31679 分 获得前端代码竞技场榜首,超过 Claude Fable 5 的 1631 分,并首次超越 GPT-5.6 Sol 等闭源模型,刷新国产大模型在工程落地能力上的表现。

𝕏 马斯克称 SpaceX 工程数据将用于 Grok 2T 补充训练

Elon Musk 确认,SpaceX 的大规模工程数据将加入 Grok 2T 补充训练,但会排除受 ITAR 限制的材料。该训练目标是提升模型在工程设计、复杂系统分析和工程推理任务中的能力。

美国评估中国开源权重模型进入云服务的政策风险

围绕 Kimi K3 等中国开源权重模型的影响,美国政策圈重启相关风险讨论。报道称,美国可能通过 采购规则、实体清单和安全提示限制中国开源权重模型进入云服务目录,相关争议集中在供应链、合规和国家安全。

🔶 谷歌 Frozen v2 服务器芯片拟提升 Gemini 推理效率

谷歌 正研发代号 Frozen v2 的服务器芯片,目标在 2028 年 部署,把 Gemini 推理能力更深地写入硬件层。报道称该芯片计划让每瓦 Token 效率提升 6 至 10 倍,以降低大模型推理成本。

𝕏 阿里发布 Qwen-Image-3.0,强化长提示词、文字渲染与多语言排版

阿里千问 发布 Qwen-Image-3.0 图像模型,支持 4.5k token 输入、12 国语言渲染、单图生成九宫格,并在复杂文字内容、学术论文式图像和版面布局上展示更强能力。该模型重点补齐图像生成中长期较难的文字排版和长提示词遵循问题。

𝕏 Qwen-Audio-3.0-TTS 支持跨语言音色复刻并登顶语音榜单

通义千问 发布 Qwen-Audio-3.0-TTS-Plus支持用一段参考音跨 16 种语言 和 20 种方言复刻音色,首包延迟达到 300 毫秒级。该模型还在 Artificial Analysis Speech Arena 排行榜升至第一,展示其在语音合成质量和低延迟交互上的进展。

𝕏 Motif-3-Beta 开源发布,3140 亿参数 MoE 支持 256K 上下文

Motif-3-Beta 已在 Hugging Face 发布,采用 3140 亿总参数130 亿激活参数 的 MoE 架构,并支持 256K 上下文。模型使用 384 专家稀疏路由,面向长上下文与大规模开源模型应用场景。

智谱落地 1GW 全国产 AI 芯片数据中心

智谱 收购中科加禾并落地 1GW 全国产芯片数据中心,叠加自研模型和中科院 Infra,推动自主 AI 算力闭环。该布局指向从模型、基础设施到算力供给的国产化整合。

𝕏 腾讯混元发布 Hyra-1.0 研究智能体

腾讯混元 推出 Hyra-1.0,面向 AI4AI、AI4Science、工程研究和内容创作任务。该智能体强调递归改进解法能力,定位为辅助模型研发、科学发现与复杂研究流程的研究型智能体。

𝕏 Sakana AI 发布 Fugu-Cyber 安全编排模型更新

Sakana AI 发布 Fugu-Cyber 更新,称其在真实网络安全基准上表现可匹配 GPT-5.5-Cyber 和 Mythos Preview。该模型面向安全任务编排,突出自动化网络安全工作流中的模型能力提升。

𝕏 Cursor 研究称多模型智能体可将复杂任务成本降低 15 倍

Cursor 研究显示,由前沿模型负责规划、低成本模型执行的 多模型智能体 架构,可让复杂任务总 token 成本降低 15 倍。该思路强调把昂贵模型用于关键决策,把低成本模型用于可拆分执行环节。

𝕏 Kimi K3 用单提示词生成可玩 MMORPG Demo

Kimi K3 用单个提示词在 55 分钟 内生成一个可玩的 MMORPG Demo,包含骑马、跑酷、战斗和开放世界等机制,成本约 9.37 美元。该案例展示其在长程前端生成和游戏原型搭建中的执行能力。

🔶 国家超算互联网上线 Kimi K3 API 服务

国家超算互联网 上线 Kimi K3 API 服务,并兼容 OpenAI 与 Anthropic 接口。该上线降低了开发者接入 Kimi K3 的迁移成本,也扩展了国产模型在公共算力平台中的可用性。

𝕏 BaseRT 让 Apple Silicon 本地大模型推理提速 6.4 倍

BaseRT 面向 Apple Silicon 做本地推理优化,可让 Mac 上的大模型推理速度提升 6.4 倍。该项目聚焦端侧大模型运行效率,适合关注本地部署和隐私场景的开发者。

𝕏 Gemma 4 31B 接入开源语音到语音 AI 栈

Gemma 4 31B 通过 Hugging FaceCerebras 实现超高速推理,可作为开源语音到语音应用的大脑。该组合指向低延迟语音交互应用中的开源模型替代方案。

阿里千问上线 Qwen3.8-Max-Preview 新版,提升 WebDev 表现

阿里千问 上线 Qwen3.8-Max-Preview 新版,重点提升 WebDev 前端表现。该更新与 Qwen 系列近期在代码、图像和语音方向的密集发布相互呼应,但属于独立的模型版本迭代。

🔶 Kimi K3 引发关于模型护城河向生态迁移的讨论

Kimi K3 参数规模达 2.8 万亿,相关分析认为模型壁垒正从单点能力转向 算力成本、渠道生态和合规场景。该条更偏产业观点,信息增量主要在于对开源权重模型竞争格局的判断。


EVENT-DRIVEN INTELLIGENCE

免费先跟踪重点,再决定是否升级

每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。

分享

NEXT STEP · 留下邮箱

获取下一次重大事件提醒

每天一封精选情报,先用邮件建立复访,再决定是否升级到更深的追踪能力。