07月17日 · 科技晚报

天眼晚报

科技|2026年07月17日|59 分钟阅读
来源:1051 条推文 + 125 篇 RSS 文章·Lanyun·DeepSeek 生成·2026-07-17
分享
AI 速读19 条精选

🤖 AI 大模型

𝕏 月之暗面发布 Kimi K3:2.8 万亿参数开源模型登顶多榜单

月之暗面 (Moonshot AI) 发布 Kimi K3,全球首个 2.8T 参数开放权重模型,采用 MoE 架构(896 专家激活 16),支持 100 万/1M token 上下文与原生多模态。权重将于 7 月 27 日前 开源。性能方面:在 Frontend Code Arena 以 1679 分 超越 Claude Fable 5GPT-5.6 Sol 排名第一,Vals Index 整体排名第二(仅次 Fable 5)。API 价格比 Fable 便宜约 3 倍(输入 $3/$15),编码场景缓存命中率超 90%。开发者用 $3.24 即可创建 CS:GO×Portal 克隆游戏(约 60 万 token)。Anthropic 算力是 Moonshot 的 50-150 倍,但 K3 已接近前沿水平。

𝕏 GLM-5.2 推理成本对比:4x DGX Spark 月费 18000 美元

第三方测试显示,GLM-5.2在 4x DGX Spark 上推理成本为 18000 美元/月(30 tok/s),4x RTX Pro 6000 为 60000 美元/月(80 tok/s)。该模型可通过 subagent 研究 API 并构建机器人。

𝕏 Fable 5 从需政府管制到$20/月,仅 6 周

评论:6 周前 Fable 5 因过于先进需要政府介入并下线,如今可用模型已更好,每月仅 $20。AI 模型能力普及速度惊人。

𝕏 DeepSeek V4 正式版可能因 Kimi K3 推迟

消息称DeepSeek原计划 7 月中旬发布V4 正式版并涨价,但截至 7 月 17 日尚无动静。网友猜测因 Kimi K3 发布、开源模型竞争激烈,DeepSeek 可能调整策略。

𝕏 vLLM+LMCache 实现 2.8x 加速,无需 GPU

开源项目vLLMLMCache结合,对重复提示实现2.8 倍加速,无需额外 GPU。LMCache 存储 KV 缓存张量,支持多层次缓存,可适配多种推理引擎和硬件。GitHub 10K stars。

𝕏 Meta Muse Spark 1.1 上线 OpenRouter,价格仅为旗舰模型 1/4

MetaMuse Spark 1.1 部署至 OpenRouter,定价为 OpenAI 和 Anthropic 旗舰模型的四分之一,加剧编码 Agent 价格战。

𝕏 Google NotebookLM 更名为 Gemini Notebook

Google 宣布 NotebookLM 更名为 Gemini Notebook,未来几周用户将看到新名称和图标。该产品仍作为独立应用提供,仅是品牌统一到 Gemini 生态。

𝕏 Google 为 Gemini API 的 Managed Agents 添加免费层与预算护栏

GoogleGemini API 的 Managed Agents 新增免费层,开发者无需绑定账单即可构建 Agent,并可通过设置 max_total_tokens 控制成本,还支持内置 cron 定时触发,降低 Agent 开发门槛。

微软筹备 AI 漏洞检测工具 Project Perception 对标 Mythos

微软 正筹备一款 AI 漏洞检测工具 Project Perception,计划 7 月内发布。该工具将对标 Anthropic 旗下的 Mythos 模型,且预计更具成本效益。

𝕏 彭博社爆料 Google Gemini 3.5 Pro 因编程能力不达标延期发布

彭博社报道,Google旗舰大模型Gemini 3.5 Pro发布推迟数月,原因是编程能力未达到内部目标。


EVENT-DRIVEN INTELLIGENCE

免费先跟踪重点,再决定是否升级

每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。

分享

NEXT STEP · 留下邮箱

获取下一次重大事件提醒

每天一封精选情报,先用邮件建立复访,再决定是否升级到更深的追踪能力。