天眼晚报
科技|2026年08月05日|约 66 分钟阅读
AI 速读19 条精选
🤖 AI 大模型
𝕏 【重磅】字节发布 SeedRealtime,原生融合音视频文本三模态实时决策
字节推出 SeedRealtime 大模型,支持 连续视频流 处理,实现边看、边听、边说。模型将声音、画面与表达纳入同一决策层,解决同音词消歧与视觉指向问题;在四人聚餐场景中可准确区分不同说话人并持续对话。现已在 豆包 App 全量上线。
⭐ MiniMax 开源 H3 视频模型,登顶 Hugging Face 榜首
MiniMax 发布 SOTA 开源权重 H3 视频模型,在视频编辑评测榜和图生视频排行榜均位列全球第一。社区验证其在 RTX 3060 等中端显卡上可离线运行,16GB VRAM 设备即可生成高质量视频。开源 24 小时内获超百家合作伙伴适配,股价 4 日累计涨近 25%。
𝕏 ⭐ Alibaba Qwen3.8-Max 前端代码能力超越 Fable 5
Alibaba 发布 Qwen3.8-Max,在 前端代码 任务上表现优于 Fable 5,参数量达 2.4 万亿。该模型支持自主运行编码项目,从空文件夹到生产应用仅需 16 天,无人工干预。
【重磅】英伟达开源 Alpamayo 2 Super 自动驾驶大模型,340 亿参数支持推理与解释
英伟达 正式开源 Alpamayo 2 Super,基于 Cosmos 3 的 34B 视觉-语言-动作模型,参数量为前代 3 倍。该模型不仅能感知,还能进行因果推理和动作规划,输出包含轨迹、因果链及 VQA 回答的五类信息;采用 OpenMDW-1.1 许可,支持商业部署,在 LingoQA 基准测试中得分 79.2,超越 GPT-4o。
⭐ 商汤 SenseNova U1 Pro 实现 8K 原生渲染与自我修正
商汤 发布多模态模型 SenseNova U1 Pro,支持 8K 原生图像渲染。该模型内置 自我修正机制,可在数十轮推理中自动比对生成结果与指令并
EVENT-DRIVEN INTELLIGENCE
免费先跟踪重点,再决定是否升级
每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。