08月11日 · 科技晚报

天眼晚报

科技|2026年08月11日|79 分钟阅读
来源:916 条推文 + 206 篇 RSS 文章·Lanyun·DeepSeek 生成·2026-08-11
分享
AI 速读18 条精选

🤖 AI 大模型

𝕏 百灵 MoE3 模型暂无法在 Ollama 和 llama.cpp 中运行

开发者尝试本地运行百灵 MoE3导入Ollama时报错“unknown model architecture: 'bailingmoe3'”,llama.cpp目前也不支持该架构,需等待适配。

𝕏 Meta 开源 Muse Glimmer 30B:本地可运行,成本仅为 Spark 五分之一

Meta Superintelligence Labs 发布Muse Glimmer,30B 参数,采用Apache 2.0开源许可;4-bit 量化后内存不足 20GB,可在单张消费级 GPU 运行。该模型从 Muse Spark 蒸馏而来(29.6B 稠密),支持 131K+上下文;运行 5 个可玩游戏耗资0.02 美元,约为 Spark 的 1/5。游戏生成质量击败 Gemma 4 31B,但 Token 消耗是后者的 4.7 倍。LMArena 评测中,Code Arena WebDev 排名第 77(1359 分)、开源第 26;Text Arena 第 97、开源第 24。RTX 5090 解码速度达233 tokens/s

𝕏 跨模型 KV 缓存复用技术:TTFT 降低 2.22 倍,质量保持 94%

开发者复现 NVIDIA 论文,用小型模型做 prefill,大型模型从KV 缓存生成。在 2xRTX 3090 上 TTFT 降低2.22 倍,质量保留 94%,且无需 fork,基于标准vLLM实现。

𝕏 Anthropic 为 Claude 输出添加隐形水印,8 月 2 日后新模型全面启用

AnthropicClaude生成文本中嵌入隐形水印,通过统计模式标记出处,复制粘贴或轻度编辑后仍可检测;为符合欧盟AI 法案,自 2026 年 8 月 2 日起新模型全量启用,覆盖 API 与云服务。

𝕏 腾讯混元发布 Hy3D WorldClaw:文本生成可探索 3D 开放世界

腾讯混元发布Hy3D WorldClaw,通过 agentic workflow 从文本提示生成大规模 3D 开放世界,场景全部由可编辑、游戏就绪的 3D 资产构成,而非视频或高斯溅射。

𝕏 Seedance 2.5 上线 Lovart:支持 30 秒电影级 AI 视频

Seedance 2.5Lovart AI平台上线,可生成最长30 秒的电影级视频,角色一致性、运镜和编辑体验显著提升,prompt 到成片可在同一工作区完成。

𝕏 Kimi K3 正式上线 Databricks

月之暗面Kimi K3模型已在Databricks平台上线,用户可以在此直接调用该模型进行推理与应用开发。

𝕏 DeepSeek V4 API 定价公布:Flash 命中输入低至 0.02 元/百万 token

DeepSeek V4公布 API 价格:Flash 输入命中0.02 元、未命中 1 元,输出2 元/百万 token;Pro 输出 6 元,并发限制 2500 和 500(按账号粒度)。

𝕏 Grok Imagine 升级 Image 2.0:支持图像精修与多参考合成

Grok Imagine推出Image 2.0,可对照片进行精准编辑、合并5 张参考图、渲染清晰文字、调整尺寸并移除背景,成为真正的创意工具。

𝕏 阿里 Wan-Animate-2 发布:单次生成多机位 AI 视频

阿里发布Wan-Animate-2,可在一次生成中输出不同角度的视频,并保持角色与环境一致,被评价为 AI 视频多机位能力的重要一步。

𝕏 智谱 ZCode 用户突破 100 万,重置额度回馈社区

智谱 ZCode宣布用户数达100 万,通过重置额度回馈社区;AI 编程工具发放重置福利或成行业标配。

𝕏 Grok 4.5 免费开放:全新 Opus 级模型,主打编码

Grok 4.5 正式免费开放,定位 Opus 级模型,运行更快、成本更低,专为真实编码与工程任务设计,即日起可用。

𝕏 webAI 开源 3B 形式化推理模型 TwiL-LM3,多项超 GPT-OSS-120B

webAI 开源TwiL-LM3,仅3B 参数,在 5 项形式化推理基准中 4 项超越OpenAI GPT-OSS-120B,推理速度快 2.6 倍,可运行于树莓派。

Anthropic 未发布 Claude 模型推进黎曼猜想,零点下限提至 67.2%

Claude研究版模型在 Claude Code 环境中自主运行,消耗3100 万输出 Token,将黎曼 Zeta 函数零点符合猜想的比例下限从41.6%提升至67.2%,并已通过 Lean 形式化验证。

微软发布 MAI-Image-2.6 图像生成模型,Arena 排名第二

微软发布MAI-Image-2.6,在 Arena 图像生成榜排名第二,仅次于GPT-Image-2

DeepSeek 组建 Harness 团队,对标 Claude Code 开发代码智能体

DeepSeek组建 Harness 团队,主攻代码智能体产品,对标 Anthropic 的Claude Code

𝕏 PDF 文件名可显著影响 LLM 评审分数

实验显示,仅将上传的 PDFpaper.pdf 改名为 paper_final_draft_pdf_ready_for_review.pdf,即可提高 gpt-5.6-terra 的平均评审分数,揭示 LLM 评估中的偏差。


EVENT-DRIVEN INTELLIGENCE

免费先跟踪重点,再决定是否升级

每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。

分享

NEXT STEP · 留下邮箱

获取下一次重大事件提醒

每天一封精选情报,先用邮件建立复访,再决定是否升级到更深的追踪能力。