08月27日 · 科技早报

天眼早报

科技|2026年08月27日|68 分钟阅读
来源:1049 条推文 + 180 篇 RSS 文章·Lanyun·DeepSeek 生成·2026-08-26 — 2026-08-27
分享
AI 速读18 条精选

🤖 AI 大模型

𝕏 智谱发布 GLM-5.3-Flash:320B-A18B 开源,Ox Alpha 真身亮相

智谱正式发布GLM-5.3-Flash,即此前登顶榜单的神秘模型Ox Alpha。该模型为320B-A18B稀疏 MoE,原生多模态,支持 100 万 token 上下文,采用 KDA+MLA 混合注意力架构,以 MIT 许可证开源,并已完全运行在中国 AI 芯片上,每日处理超 100 万亿 token。官方 API 输入价 0.15 美元/百万 token,输出 0.50 美元,首两周 5 折;单任务成本仅 0.24 美元,63%成功率登顶性价比榜,编码比肩 Claude Opus 4.8。OpenRouter 确认其 6 天处理超 20 万亿 token,Databricks 也将上线该模型。

𝕏 阿里开源 Qwen3.8-Flash-Next:Qwen4 架构预览

阿里开源Qwen3.8-Flash-NextQwen4架构预览,125B 参数/6B 激活,采用 510 亿参数 N-gram 嵌入与稀疏注意力。以 1/3 参数和 1/9 训练成本,在 14 项基准中 8 项领先 Qwen3.7-Plus;Code Arena WebDev 得分 1617,开源模型排名第 3。原生支持 1M 上下文,价格$0.16/$0.47。vLLM已上线支持,适配 NVIDIA 与 AMD GPU。

𝕏 阿里发布 Qwen3.8-Flash:Qwen4 架构预览

阿里发布并开源Qwen3.8-Flash,多模态 MoE 模型,总参数125B(含 51B N-gram 嵌入),每 token 仅激活 6B,原生上下文 262K。训练成本仅为前代 Qwen3.7-Plus 的1/9,SWE-bench Pro 达 62.5,编程办公性能超越 Qwen3.7-Plus,B200 上解码速度 540 tok/s。API 输入价$0.16/百万 token,被视作 Qwen4 架构预览。

𝕏 Google 发布 Gemini 3.5 Transcribe 语音转写模型

Google发布Gemini 3.5 Transcribe语音转写模型,支持85+种语言、智能转写(自动去口语、规范数字日期)、自定义词汇和多说话人识别,提供实时与音频文件双接口。非流式 AA-WER 仅2.6%,Live 版延迟 0.40 秒,API 现已开放。

𝕏 Perceptron 开源具身基础模型 Isaac 0.5

Perceptron发布开源具身基础模型Isaac 0.536B参数动态 MoE,将多模态视频理解、具身推理和机器人控制集成于单一稀疏骨干网络。遥操作数据需求减少210 倍

𝕏 fal 发布 MiniMax H3 Max 视频生成模型,图生视频登顶

fal发布MiniMax H3 Max视频生成模型,在 Artificial Analysis 上图像转视频排名第 1、文本转视频第 3,生成速度较基础 H3 提升近50 倍,定价**$0.04/秒**,并计划开源。

𝕏 Yutori 发布 Navigator n2 计算机使用模型

Yutori发布Navigator n2计算机使用模型,仅27B参数,可操作完整桌面与命令行,执行计算机界面交互任务。

Google推出Gemini Enterprise for Legal,面向法律行业,接入 DocuSign、Harvey 等主要法律科技平台。

𝕏 Breeze TTS 2 开源,登顶开放语音合成榜

Breeze TTS 2开放权重,登顶开源 TTS排行,可自行部署。

𝕏 Meta 发布 Muse Image 模型

Meta发布Muse Image模型,可推理渲染,API 定价0.01 美元/张

𝕏 腾讯开源微信多模态 Embedding 模型 WeMM-Embedding

腾讯开源WeMM-Embedding,含 2B/4B/9B 三档,其中 9B 版本登顶MMEB-v2/v3基准。


EVENT-DRIVEN INTELLIGENCE

免费先跟踪重点,再决定是否升级

每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。

分享

NEXT STEP · 留下邮箱

获取下一次重大事件提醒

每天一封精选情报,先用邮件建立复访,再决定是否升级到更深的追踪能力。