天眼早报
🤖 AI 大模型
𝕏 Meta 发布开源 30B 多模态模型 Muse Glimmer
Meta发布开源Muse Glimmer模型:30B参数多模态推理,混合注意力架构,上下文 131K,KV 缓存仅 52KiB/token,性能接近 Qwen3.6。在多个 Agent 基准上领先,10M 长上下文 RULER 达93.3%,游戏生成胜过 Gemma 4 31B(但耗用 83.4K tokens),支持单卡部署。开发者 Pokee 实测对比显示其综合表现优秀。
𝕏 LTX 2.5 视频模型开源权重发布
Lightricks正式开源LTX 2.5视频模型权重,包含 int8、BF16、NVFP4 等多种量化版本,并放出时间/空间上采样器、蒸馏 LoRA 和 VAE,完整资源已上传Hugging Face。
🔵 彭博播客聚焦 Kimi K3 在中美 AI 竞赛中的角色
彭博播客聚焦中国 AI 公司月之暗面发布的Kimi K3模型,认为其成为中美 AI 竞赛的重要新变量,影响全球 AI 主导权争夺格局。
𝕏 Soniox TTS v2 发布:60+ 语言,支持情感控制
Soniox TTS v2 支持 60+ 语言、高保真克隆、低延迟流式输出,定价 $0.70/小时,可用音标签控制耳语、笑声等。
𝕏 Anthropic 为 Claude 新模型加入隐形文本水印
Anthropic为Claude新模型加入模型级隐形文本水印,并计划将给所有 Claude 文本嵌入水印,以符合欧盟AI 法案的透明度要求。同时推出检测 API,可识别 Claude Code 生成的 PR,检测工具开发中。
𝕏 微软 MAI-Code-1.1-Flash 登陆 GitHub Copilot
微软 MAI-Code-1.1-Flash 在 Copilot 推出,支持原生视觉,价格比上代低 73%。
𝕏 Grok 4.6 本周发布,并扩大 Grok Bot 测试
马斯克表示将在修复初期问题后于本周发布 Grok 4.6,扩大 Grok Bot 测试范围。
𝕏 DeepSeek V4 Flash 开放微调
Together AI 上可对 DeepSeek V4 Flash 0731 进行 SFT/DPO 微调,并部署生产推理。
𝕏 NVIDIA 发布 Nemotron 3.5 Lightning:30B 开源模型速度提升 4 倍
NVIDIA发布开源Nemotron 3.5 Lightning:31.6B总参数 MoE(3B 激活),支持 100 万 token 上下文,输出速度近 670 token/秒,vLLM 下吞吐最高提升4 倍,任务完成时间降低 30%,agentic 能力超越 gpt-oss-120b,开放权重、数据和训练配方。该模型已上线 Ollama,面向常驻运行 Agent,可配合 Claude Code、Hermes Agent 使用,支持本地部署。与 Ollama 及 NVIDIA CEO 黄仁勋合作推出。
𝕏 Dyna Robotics 发布 Dyna-2:用 100 万小时人类视频预训练机器人模型
Dyna-2在100 万小时人类视频上预训练,数据增至百万小时后操作精度仍单调提升,少量遥操作即可部署到真实硬件。
𝕏 MiniMax H3 视频模型上线 fal 平台
MiniMax H3在fal上线,支持文本/图片/参考图生成视频,水流、布料等物理表现大幅提升。
𝕏 FLUX 3 Video 文生视频全球第二,免费至 8 月 16 日
FLUX 3 Video以1496 分在文生视频 Arena 排名第二,仅落后 Gemini Omni Flash 16 分;官方宣布免费至 8 月 16 日,后续将支持 4K 与视频编辑。
𝕏 GPT-5.6 Sol 在 ARC-AGI-2 基准达 92.5%,较 o3 提升 14 倍
GPT-5.6 Sol在 ARC-AGI-2 达92.5%,较 o3(6.5%)提升14 倍。
𝕏 webAI 开源 3B 形式化推理模型 TwiL-LM3,超越 GPT-OSS-120B
webAI开源3B模型 TwiL-LM3,4 项基准超越GPT-OSS-120B。
EVENT-DRIVEN INTELLIGENCE
免费先跟踪重点,再决定是否升级
每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。