天眼晚报
科技|2026年08月09日|约 59 分钟阅读
AI 速读16 条精选
🤖 AI 大模型
𝕏 阿里发布 Qwen3.8-Max 旗舰模型,2.4 万亿参数开源在即
阿里巴巴发布Qwen3.8-Max,拥有2.4 万亿参数与100 万 token上下文,原生支持视觉与文本,API 输入价**$2/百万 token**,开源权重下周上线 Hugging Face,为首个开源 Max 级模型。
𝕏 DeepSeek V4-Flash 性能大幅领先,成本仅为三分之一
DeepSeek V4-Flash 在 SWE-Bench 测试中大幅领先 V3.2(61.4% vs 4.0%),成本仅为 V3.2 的 1/3;在 DeepSWE 测试中,两次 V4-Flash 比一次 GPT-5.6 Luna 解决更多任务。
𝕏 中国 10T 参数 MoE 模型或需 3 万块 Blackwell,字节已租 3.6 万块
分析师估算,中国10T 参数 MoE模型训练约需3 万块 Blackwell;字节已租用36,000 块GPU(25 亿美元)。
𝕏 MiniMax H3 AMA:计划开源统一图像编辑模型
MiniMax回应社区,计划开源H3-Regenerate-2K和统一文生图/编辑模型,采用MoBA稀疏注意力,并发布 H3 技术报告。
𝕏 SemiAnalysis:OpenAI 克服预训练难题 新模型 Doug 在建
SemiAnalysis称OpenAI已克服预训练问题,代号"Doug"的更大模型正在开发中。
𝕏 DeepSeek 模型层数持续缩减 V4 仅 43 层
DeepSeek模型层数从 V1 的95 层降至 V4 的43 层,而LLaMA-405B有126 层,原始深度重要性下降。
𝕏 经济学人:中国 AI 模型正快速变强
经济学人撰文称,中国 AI 模型并非只有低价优势,正在快速增大规模并提升能力。
🔶 苹果回应删除千问集成文档:未收到通知,大陆功能未上线
苹果称未收到通知,大陆尚未推出“Apple 智能使用千问”功能,相关文档上线不足 24 小时即被删除。
EVENT-DRIVEN INTELLIGENCE
免费先跟踪重点,再决定是否升级
每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。