08月31日 · 科技晚报

天眼晚报

科技|2026年08月31日|64 分钟阅读
来源:837 条推文 + 313 篇 RSS 文章·Lanyun·DeepSeek 生成·2026-08-31
分享
AI 速读18 条精选

🤖 AI 大模型

𝕏 DeepSeek v4 Flash Vision Exp 开源权重正式发布

DeepSeek v4 Flash Vision Exp模型现已开放权重,开发者可下载使用,该版本支持视觉能力。

腾讯混元 Hy4 Preview 发布:7700 亿参数,花旗目标价 765 港元

腾讯正式发布混元 Hy4 Preview,总参数7700 亿、激活参数 490 亿。第三方评测显示其表现接近两倍参数竞品,在 Toolathlon-Verified 等基准上媲美甚至超越同业。花旗重申买入评级,目标价765 港元;摩根士丹利维持增持,目标价 550 港元,较 8 月 28 日收盘价有 21%上行空间。

𝕏 8 款小模型 Agent 横评:Qwen3.8-27B 表现最佳

8 款小模型Agent 横评中,Qwen3.8-27B表现最佳,测试基于 H100 运行 48 小时。

𝕏 腾讯开源 ContextPilot:强化学习让 AI 学会自主管理上下文

腾讯开源ContextPilot框架,用强化学习训练 AI 自主规划、记忆与卸载上下文;基于它训练的Qwen3-14B32K窗口下超越原生128K基座,token 消耗大幅压缩。

𝕏 GLM-5.3 登顶 Agentic 基准,超越 GPT-5.6 Sol 和 Claude Fable 5

GLM-5.3在 Agentic 基准上超越GPT-5.6 SolClaude Fable 5,未更换基座模型,仅靠扩展后训练环境与强化学习算力跃升,5.3 Flash 紧随其后。

𝕏 Anthropic 8 月扩招 37%:销售算力岗位激增,AI 研究岗反降

Anthropic 8 月新增154个职位(+37%),销售+44、算力+25、安全+23,AI 研究与工程岗位减少 14 个,商业化加速。

𝕏 Kimi K3 领跑地质学基准 Groundtruth,GLM-5.3 Flash 位居上流

地质知识基准 Groundtruth 中,Kimi K3领先,GLM 5.3 Flash处于第一梯队,V4-Pro 和 Grok 4.6 垫底,代际差距明显。

𝕏 GPT-5.6 Sol(med)称霸交互式编码:比 Fable 快 5 倍、成本低 10 倍

评测显示GPT-5.6 Sol (med)在交互式编码任务中比Fable5 倍、便宜10 倍,单任务速度超过 Flash 3.7。

MiniMax H3 系列上线 Vercel,H3 Max 视频生成速度突破

MiniMax H3系列上线 Vercel,新款 H3 Max Director 支持2 分钟连续视频;fal 优化的H3 Max可实现15 秒视频 9 秒生成,其驱动的 Infinite Slop 上线首日吸引 3.7 万观众。

💹 科大讯飞将发布星火 X2.5 基座模型,先行开源两款端侧模型

科大讯飞将于 9 月 1 日开源星火 X2.5-4B 和 1.7B 两款端侧模型,支持1M token上下文;9 月 7 日将发布293B基座模型星火 X2.5。

智谱上半年营收 9.54 亿元同比增长近 400%,API 业务暴增 2736%

智谱发布 2026 年中期业绩,上半年营收9.54 亿元,同比增长399.7%;API 业务收入 8.25 亿元,同比增长 2735.7%。MaaS 用户超740 万,Token 调用量增长超 40 倍。

𝕏 Apodex 发布 1.1 模型,智能指数 44,主打 Agentic 能力

Apodex 1.1在 Artificial Analysis 智能指数获44 分,与 Kimi K2.6 同级;在 GDPval-AA v2 上超越 DeepSeek V4 Pro,定价约0.05 美元每任务。

OpenAI 被曝购入数万台 Mac 用于强化学习训练

OpenAI被曝购入数万台Mac mini/Studio用于强化学习训练计算机使用智能体。苹果 Mac 季度营收增**29%**至 103 亿美元。

🔶 信通院牵头的大模型平台系列行业标准正式发布

工信部批准信通院牵头的大模型平台系列行业标准正式发布,覆盖数据处理、训练、推理等核心环节,4 项于11 月 1 日实施。

原力灵机 DM0.5 登顶 RoboDojo 具身评测,全面开源

原力灵机DM0.5登顶RoboDojo具身基准,综合得分24.90、平均成功率19.34%,记忆维度领先第二名近 4 倍。

𝕏 OpenAI 自研 AI 芯片 Jalapeño 年内部署,推理能效翻倍

据 SemiAnalysis,OpenAI自研推理芯片Jalapeño将于2026 年底部署到自家算力中,约 100 tok/s 速度下达 1100 万 tok/s/MW,能效约为 Blackwell 最佳配置的2 倍

𝕏 Ramp 数据:Anthropic 企业 AI 支出份额达 43.5%反超 OpenAI

Ramp 统计7 万+美国企业付款数据,**43.5%**企业付费使用 Anthropic,OpenAI 为39.7%。头部 1%企业人均月 AI 支出达7400 美元

𝕏 Qwen3.8 Flash Next 单机推理速度创 102 TPS 纪录

开发者将Qwen3.8 Flash Next在单台算力舱解码速度从 23 提升至102 TPS,18K Prefill 达2588 TPS,一台 T5000 算力舱性能接近两台 DGX G10。


EVENT-DRIVEN INTELLIGENCE

免费先跟踪重点,再决定是否升级

每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。

分享

NEXT STEP · 留下邮箱

获取下一次重大事件提醒

每天一封精选情报,先用邮件建立复访,再决定是否升级到更深的追踪能力。