08月02日 · 科技晚报

天眼晚报

科技|2026年08月02日|52 分钟阅读
来源:632 条推文 + 93 篇 RSS 文章·Lanyun·DeepSeek 生成·2026-08-02
分享
AI 速读18 条精选

🤖 AI 大模型

𝕏 【重磅】Google 发布第八代 TPU,训练与推理芯片彻底拆分

Google正式推出TPU v8系列,核心变革是训练推理芯片拆分TPU 8t专为万亿参数预训练设计,提供121 exaflops算力;TPU 8i优化实时推理,延迟降低50%,旨在解决 AI Agent 时代对低延迟的严苛需求。

𝕏 ⭐ DeepSeek V4 Flash 成本仅为 Claude Fable 5 的 1/105

Artificial Analysis报告指出,DeepSeek V4 Flash在 Terminal-Bench 2.1 基准测试中得分82.7,超越Claude Fable 580.5分,且DeepSeek V4 Flash成本仅为Claude Fable 51/105,单次任务成本低至0.03 美元。这标志着前沿 AI 模型正进入极度廉价化时代。

𝕏 ⭐ Cerebras 开源 REAP 技术,将 Qwen3.5-397B 压缩至 262B

Cerebras开源REAP技术,压缩Qwen3.5大模型:通过路由权重剪枝将Qwen3.5-397B压缩至262B总参(仍约17B激活),近无损保留编码、工具调用及视觉能力。该技术显著降低显存占用,适用于隐私本地 Agent 及边缘部署场景。

𝕏 【重磅】Karpathy 实测 Opus 5:用 100 万 Token 预算将《指环王》文本渲染为可运行 3D 世界

Andrej Karpathy测试Opus 5将《指环王》渲染为 3D 世界:投入约10 美元100 万 token)预算,要求模型用Three.js将《指环王》第一段文字渲染为 3D 场景。模型耗时2 小时生成5500 行代码,成功构建出包含建模、布景和动画逻辑的完整 3D 世界。该实验暴露了当前模型在多模态感知自我审计方面的短板,无法实时“看见”生成的内容。

𝕏 ⭐ OpenAI 内部版 Astra 破解 10 个世纪难题,单题成本仅 200 美元

OpenAI内部版Astra破解10 道世纪数学难题,在球堆积、编码理论、群论等领域取得新结果。完成所有解题仅消耗约2000 美元Token 费用(平均每道题200 美元)。每个 AI 生成的论证均由人类通过Lean形式化验证工具逐行重检,确保每一步逻辑完全自洽。

𝕏 ⭐ Grok 推出 Build Mode:手机变应用生成器,描述即建站

Grok推出Build Mode功能,描述即建站:用户只需在聊天中描述网站、游戏或仪表盘需求,系统即可在对话中实时构建并生成一键链接发布。该功能将手机转变为应用开发工具,大幅降低非技术人员创建应用的门槛。

【重磅】DeepSeek V4-Flash 正式版 API 公测:速度比 GPT-5.6 Sol 快 1 倍,成本低数十倍

DeepSeek-V4-Flash正式版开启公测,Agent 测试得分25.2 分接近 Opus-4.8(25.7 分)。相同任务仅用40 秒完成,GPT-5.6 Sol+Codex 需 1 分 47 秒;API 输入价低至1 元/百万 tokens,成本差距达数十倍。

𝕏 ⭐ DeepSeek V4-Flash 登顶 Vals Index 开源模型第三,测试成本仅 GLM 5.2 的 3%

DeepSeek V4-Flash(0731)成为 Vals Index 上排名第 3的开源权重模型,单次测试成本仅6 美分,仅为GLM 5.2Kimi K3价格的3%,几乎与 GLM 5.2 同等精度。此外,该模型在编程 Agent 场景下成本仅为Anthropic Fable的百分之一,性价比极高。

⭐ MiniMax H3 模型引发行业关注:


EVENT-DRIVEN INTELLIGENCE

免费先跟踪重点,再决定是否升级

每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。

分享

NEXT STEP · 留下邮箱

获取下一次重大事件提醒

每天一封精选情报,先用邮件建立复访,再决定是否升级到更深的追踪能力。