08月08日 · 科技早报

天眼早报

科技|2026年08月08日|66 分钟阅读
来源:761 条推文 + 35 篇 RSS 文章·Lanyun·DeepSeek 生成·2026-08-07 — 2026-08-08
分享
AI 速读18 条精选

🤖 AI 大模型

𝕏 OpenAI 将 Astra 列为首个“关键”网络安全模型,因安全风险推迟公开发布

OpenAI 将下一代模型 Astra 列为其安全框架下首个 “关键”网络安全模型,因网络安全风险推迟公开发布。官方称 Astra 在 agentic coding 和网络安全评测中能力显著,需完成安全管控后才广泛开放;Altman 强调最终不会只给少数人使用,将向公众开放。

𝕏 Claude Code 会话之间可互相发消息,Agent 协作升级

Claude Code 新增会话间通信:可将当前会话摘要发送给另一会话,被影响时会话会自动收到同步,实现多 Agent并行协作,只传摘要不传完整历史。

𝕏 vLLM 为 Qwen3.5 实现 25K tokens/s/GPU 推理优化

vLLM 与 NVIDIA 针对 Qwen 3.5GB200 NVL72 上完成优化:Blackwell 专用 FlashInfer 内核、混合缓存与 GDN 状态传输、无竞争异步调度,达到 25K tokens/s/GPU,为 Qwen 3.8 做准备。

𝕏 Red Hat 发布 DSpark 投机解码模型,GLM-5.2 提速 4 倍

红帽推出 DSpark 投机解码器,支持 Qwen3.6-35B-A3B、gemma-4-31B、GLM-5.2;GLM-5.2 解码速度由 137 提升至 551 tokens/s,峰值吞吐提升 1.57 倍。

𝕏 Kimi 应用下载量增长近 5 倍,日活提升 40%

SensorTower 数据显示,Kimi 应用下载量增长近 5 倍,日活跃用户增长约 40%,K3 热度正转化为真实用户。

𝕏 GPT-5.6 Luna 降价至 1/10 后 Token 用量激增 10 倍,超越 GLM 5.2

OpenRouter 显示,GPT-5.6 Luna 降价至原价 1/10 后,token 用量增长 10 倍,并超越 GLM 5.2,体现杰文斯悖论。

𝕏 DeepSeek-V4-Flash-0731 发布:304B 参数、1M 上下文,成 Ollama 云默认模型

DeepSeek-V4-Flash-0731 采用 304B 参数1M 上下文,FP8+FP4 混合权重;Ollama 云已将其设为默认模型,输出速度 120+ tokens/s,零数据留存,支持长时间多会话任务。

𝕏 Seedance 2.5 发布:支持 3D 运动控制与 30 秒生成,已在 SJinn Agent 上线

Seedance 2.5 发布,Magnific 独占3D 运动控制,支持 50 个多模态参考、30 秒生成和 4K 工作流,已上线 API;同时已在 SJinn Agent 上线,支持影视级战争会议场景等复杂内容生成。

𝕏 Hugging Face 发布 ScenA:文本+双声音参考生成完整场景音频

ScenA 是新的 omni-TTS 模型,输入文本描述和两段声音参考即可生成带音效的完整混合场景。

𝕏 Anthropic 6 月 API 处理约 5Q tokens,行业规模爆发

有数据显示,Anthropic 6 月通过 API 处理的 token 约 5Q,全行业每月可能已超 30Q

𝕏 Agent Arena 数据:Opus 5 性能提升但 Token 消耗激增至 21k

Agent Arena追踪模型完成任务 token 数:Opus 4.7 到 5 代际 token 从8.5k增至21k;GPT-5.6-Sol 相比 GPT-5.5 性能提升 1.5pp,token 反而从10k降至8k

𝕏 Muse Spark 1.2:文本竞技场第四,任务成本$0.40,性价比突出

MetaMuse Spark 1.2 居文本竞技场第四,定价 $1.25/$4.25;任务成本 $0.40,智能接近 Claude Opus 4.8,成本仅五分之一。

𝕏 MiniMax H3 开源视频模型发布:价格比 Seedance 2.5 便宜 4 倍,获 Vitalik 盛赞

MiniMax H3 被评价为视频模型界的DeepSeek 时刻:开源、效果接近 Seedance 2.5,但价格便宜 4 倍;Vitalik Buterin 表示,MiniMax H3 是首个在性能上超越 HunyuanVideo 1.5 的开源视频模型,称其是向开放方向迈出的强有力一步。

MiniMax H3 团队:2K 即将开源,图像模型在开发

MiniMax H3 团队称 2K 将开源,图像模型在开发,或采用 Apache-2.0

𝕏 Gemini Omni Flash 发布,支持多参考视频生成

Google 发布 Gemini Omni Flash,支持多参考视频生成与编辑。

𝕏 LangSmith:开源权重模型日活年增 9 倍

LangSmith 数据:7 月 1/3 团队运行开源模型,日活年增 9 倍

𝕏 OpenAI 公布全球 ChatGPT 使用数据

OpenAI 数据:工作场景**45%**消息让 AI 干活,非洲用量三年增24 倍

美国能源部启动 Genesis 开源模型计划

美国能源部启动 Genesis 开源模型计划,旨在推动能源领域的开放模型发展。

𝕏 OpenAI 为 ChatGPT 统一模型:Plus/Pro 默认 GPT-5.6 Sol

OpenAI 现在在 ChatGPT Plus/Pro 中统一使用 GPT-5.6 Sol 处理即时和深度思考;免费用户默认 GPT-5.6 Luna,新增 Think 按钮;内部评测显示事实错误较 GPT-5.5 减少 68%

𝕏 MiniMax 发布 Code 2.0 编程代理

MiniMax 发布 Code 2.0,基于 Pi Agent 重构,改进长任务。


EVENT-DRIVEN INTELLIGENCE

免费先跟踪重点,再决定是否升级

每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。

分享

NEXT STEP · 留下邮箱

获取下一次重大事件提醒

每天一封精选情报,先用邮件建立复访,再决定是否升级到更深的追踪能力。