08月27日 · 科技晚报

天眼晚报

科技|2026年08月27日|81 分钟阅读
来源:807 条推文 + 356 篇 RSS 文章·Lanyun·DeepSeek 生成·2026-08-27
分享
AI 速读14 条精选

🤖 AI 大模型

𝕏 Nvidia 以 129 亿美元收购开源 AI 平台 Hugging Face

据 The Information 独家爆料,Nvidia将以129 亿美元收购开源 AI 平台Hugging Face。后者拥有296 万个模型仓库、1300 万注册用户,年营收 1.5 亿美元,对应 86 倍 PS。此项收购将巩固 Nvidia 芯片生态并重返云业务,重塑 AI 基础设施竞争格局。

𝕏 智谱开源 GLM-5.3-Flash(Ox Alpha):320B 总参数/18B 激活,国产芯片支撑日 100 万亿 token

智谱 AI开源GLM-5.3-Flash(即匿名模型 Ox Alpha):320B 总参数/18B 激活,采用线性+稀疏注意力架构,完全运行在国产 AI 芯片上,支撑每日 100 万亿 token 流量。编程与智能体能力接近 Claude Opus 4.8,DeepSWE 得分 63.4,单任务成本仅 0.045 美元,约为旗舰 1/10。模型采用 MIT 开源,官方宣布 GLM-5.3 开放权重将于 8 月 28 日正式发布。

𝕏 DeepSeek 新一轮融资估值达 740 亿美元

WSJ报道,DeepSeek即将完成新一轮融资,估值达740 亿美元,成为中国 AI 领域又一起重大融资事件。其开源模型在全球开发者中拥有广泛影响力。

𝕏 阿里发布 Qwen3.8-Flash-Next:Qwen4 架构预览,1/9 训练成本对标旗舰

阿里开源Qwen3.8-Flash-NextQwen4架构早期预览):以 1/3 激活参数、1/9 训练 FLOPs 在 14 项基准中 8 项领先,智能体编程 DeepSWE 得分 58.7,支持多模态和端到端文档交付。技术拆解显示,其长文处理成本趋于线性,将 51B 参数记忆查询表移入内存,采用层间四频道与Muon优化器。官方称超 Qwen3.7-Plus,9 月云栖大会发布 Qwen4。

𝕏 Perceptron 开源机器人基础模型 Isaac 0.5

Perceptron发布Isaac 0.5——36B 参数稀疏机器人基础模型,通过扩展无动作视频将遥操作需求降低210 倍。单次演示即可让动作损失降低 7-10.5 倍,显著优于π0.5。

𝕏 智谱发布 GLM 5.3 Flash 与 Ox Alpha,加速 Blackwell 部署

智谱推出GLM 5.3 Flash和 Ox Alpha,Radix AI 正开发 NVFP4 checkpoint 约 200GB,为英伟达Blackwell平台部署带来显著提速。

DHH 实测同一编程任务:Fable 550 美元,DeepSeek 仅 23 美元

传奇程序员DHH测试 Python 库转 Rust:Fable最快 45 分钟但成本550 美元,DeepSeek 耗时 2 小时 45 分仅23 美元,三者输出完全相同。顶尖模型性能差距缩小、成本天差地别。

𝕏 Anthropic 与 Nscale 达成 450 亿美元云算力协议

Anthropic与英国 AI 基建公司Nscale签署约450 亿美元云计算协议,为Claude 模型获取算力。这是 AI 算力军备竞赛中又一笔巨额合同。

𝕏 MiniMax 前高管杨斌开源 Breeze-TTS-2,支持声音克隆与情绪控制

MiniMax技术合伙人杨斌创立的BreezeBlue开源Breeze-TTS-2,支持中英双语、声音克隆、文本描述造声、情绪语速指令及括号语气词渲染。

𝕏 谷歌发布 Gemini 3.5 Transcribe 语音转文本模型

谷歌发布Gemini 3.5 Transcribe语音转文本模型,支持说话人识别、时间戳、去除语气词,可语音调用工具,已通过Gemini API公共预览,AI Studio 可免费调用。

𝕏 阿里云下调 Qwen3.8-Flash 价格对标智谱

阿里云下调Qwen3.8-Flash调用价格,直接对标GLM-5.3-Flash,但智谱限时 5 折仍占优。

𝕏 OpenAI 承认路由 Bug:约 3%的 Pro 和 Thinking 请求被切到 mini

OpenAI承认路由错误:约3%的 Pro 和 Thinking 请求在后台被切到GPT-5.5-mini。已修复并道歉,但用户难以察觉模型被替换。

𝕏 谷歌发布连续血糖监测基础模型 GlucoFM

谷歌发布GlucoFM血糖监测基础模型,支持糖尿病风险、胰岛素敏感性及餐后血糖预测,评分指标提升7.5%

𝕏 谷歌将 90 人 AI 责任团队从 DeepMind 迁至全球事务部

谷歌90 人AI 责任团队从DeepMind迁至全球事务部,强化安全研究对产品决策的指导。

𝕏 GLM 5.3 Flash 推理成本估算:单 NPU 达 1 万 tokens/秒

分析师估算GLM 5.3 Flash单 NPU 吞吐10K tokens/秒,100T/日需求约需11.6 万颗芯片。

𝕏 智谱国产推理集群超 10 万卡,MiniMax 同步布局

智谱国内推理集群已超10 万卡昇腾、摩尔线程、海光),MiniMax 也在建设大规模国产算力集群。

𝕏 fal 发布视频模型 H3 Max:质量评测第一、生成提速

fal发布H3 Max视频生成模型,评测质量第一5 秒 720p视频生成仅需3 秒,首周 5 折。

𝕏 奥特曼称 OpenAI 年底前将拥有 AGI 系统

OpenAI CEO奥特曼表示,今年年底公司内部将有他称之为AGI的系统。该表态引发 AI 社区对 AGI 定义和时间表的广泛讨论。

𝕏 阿里 Qwen 团队获 ACL 最佳资源论文奖

阿里在 ACL 大会获最佳资源论文奖,其Qwen系列模型在 AI 社区应用广泛,论文作者 Tian Lan 接受采访。


EVENT-DRIVEN INTELLIGENCE

免费先跟踪重点,再决定是否升级

每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。

分享

NEXT STEP · 留下邮箱

获取下一次重大事件提醒

每天一封精选情报,先用邮件建立复访,再决定是否升级到更深的追踪能力。