天眼晚报
🤖 AI 大模型
【重磅】Anthropic 发布 Claude Haiku 5.5,短上下文价格直降 90%
Anthropic 正式发布 Claude Haiku 5.5,定位为最廉价、最快且最强的小模型,支持 100 万 token 上下文,补齐 Claude 5.5 系列(Opus、Sonnet、Haiku)最后一环。新定价下,10 万 token 以内输入价格降至每百万 $0.10、输出 $0.50,短上下文降幅最高达 90%;同时新增 adaptive thinking 参数可调节思考深度,缓存读取价格减半。不过新分词器使长文本多用 25%-30% Token,实际综合成本降幅约 75%。
🔶 【重磅】OpenAI 全面推送 GPT-6,首推「Intelligent UI」交互界面
OpenAI 正式向全球所有用户(含免费与 Go 用户)推送 GPT-6,取代 GPT-5.6 系列。核心升级是 Intelligent UI,模型可直接生成可交互的图表、按钮、计算器与表单,通过原生组件库流式渲染解决生成式界面的延迟问题,使对话从纯文本转向可视化操作界面。免费与 Go 用户使用 GPT-6 Luna,付费用户使用 GPT-6 Sol;联网首答速度比上代快 44%。
【重磅】OpenAI 发布 GPT-6 与智能 UI,Anthropic 同日推出 Claude Haiku 5.5
OpenAI 今日正式发布 GPT-6 模型并推出全新智能交互层(Intelligent UI),支持生成交互式图表、按钮和工具;Anthropic 同步发布 Claude Haiku 5.5,聚焦低成本与高频调用。两家巨头在产品形态与成本效率上展开差异化竞争。
【重磅】IBM 量子计算机实现里程碑突破:19 秒完成超算需 110 年的任务
IBM 最新量子处理器在复杂运算中仅耗时 19 秒,而同等任务由全球顶尖超级计算机(如 Frontier)完成需 110 年。这一结果被视作验证 量子优势 的重要里程碑。
【重磅】微软发布 MAI Code1.1Flash 模型,GitHub Copilot 支持本地与云端混合推理
微软 推出 MAI Code1.1Flash MoE 模型(1370 亿总参数),并集成至 GitHub Copilot,实现本地与云端混合推理。该模型搭载于新款 Surface Laptop Ultra,支持 NVIDIA RTX Spark 硬件,可在设备端与云端自动调度,显著降低内存占用并提升编码响应速度,标志着 AI 编码助手向“云 + 端”协同架构演进。
⭐ Meta Muse 引爆算力需求:花旗预测 CPU 市场规模将扩张至 3000 亿美元
花旗研报指出,Meta Muse 等自主智能体应用将重塑硬件需求,预计 CPU 潜在市场规模从 2025 年 290 亿美元扩张至 2030 年的 3000 亿美元。若 Muse 达到 1 亿日活,需 20 万至 39 万块 Blackwell GPU,为英伟达带来 70 亿至 190 亿美元收入。
⭐ OpenAI 与博通拟筹 300 亿美元债务融资,加速 AI 芯片定制合作
博通正筹划为 OpenAI 购买定制芯片提供约 300 亿美元债务融资,此前已启动支持 Anthropic 的 600 亿美元计划。此举标志着芯片商与 AI 开发商从技术合作延伸至资本绑定,旨在支撑 AI 基础设施的巨额开支。
⭐ OpenAI 推出 GPT-6.1 Sol,性能接近 Astra 但成本仅为五分之一
OpenAI 发布 GPT-6.1 Sol 模型,在智能编码和计算机操作任务上接近 GPT-6 Astra,但价格仅为后者的 1/5。输入 token 定价 $2/百万,缓存输入定价降至 $0.10/百万,大幅降低推理成本。
🔶 ⭐ DeepSeek 新一轮融资逼近 1000 亿,宁德时代或成最大投资方
据媒体报道,杭州深度求索(DeepSeek)已接近锁定最新一轮至少 800 亿元人民币融资,最终规模可能逼近 1000 亿元。消息指出 宁德时代 与 腾讯控股 或成为承诺出资金额最高的投资方,所筹资金将为公司 IPO 铺路。
𝕏 ⭐ Google DeepMind 开源端侧多模态嵌入模型 EmbeddingGemma 2
Google DeepMind 开源 EmbeddingGemma 2,这是一款专为端侧设计的 740M 参数多模态嵌入模型。它支持文本、代码、图像、视频和音频映射进同一向量空间,纯文本场景仅需 270M 参数,量化后可在手机本地运行,显著提升隐私优先的端侧搜索与 RAG 能力。
⭐ Mistral 发布 Le Chonk,号称中国以外最强开源权重
Mistral 推出新模型 Le Chonk(Mistral Large 4),总参数达 1 万亿、激活 49B,号称“中国以外最强开源权重”。实测显示其在网络安全领域表现强劲,但第三方测试显示综合评分仍落后于部分中国开源模型,如 GLM-5.3 与 Kimi K3。
🔶 ⭐ Manus 完成超 5 亿美元新一轮融资,腾讯红杉继续加持
Manus 母公司蝴蝶效应近日完成超过 5 亿美元新一轮融资,由博裕投资、IDG 资本领投,老股东腾讯、红杉中国、真格基金继续加持。该消息显示市场对 AI 代理类产品的持续看好。
⭐ Claude 悄悄上线简繁体中文界面:产品菜单中文化
Anthropic 为 Claude 网页版与桌面端新增 简体中文 与 繁体中文 界面选项,无需浏览器翻译即可操作产品菜单。此举虽未正式官宣,但标志着中文用户从“被翻译将就”转向“原生对待”,目前服务地区仍不包含中国大陆。
⭐ OpenAI o1 奠基人:多 Agent 贡献不足 10%,核心在于通用模型
OpenAI 研究员 Noam Brown 指出,解决千禧年难题主要归功于强大的通用模型,而非多智能体系统。他认为 1 万个 Agent 的协作效率并未线性增长,且目前缺乏充分实验数据证明大规模协同的有效性。
⭐ Reflection 发布首款开放权重模型 Beam,对标 GLM 与 DeepSeek
美国创业公司 Reflection 发布 MoE 架构模型 Beam,总参数 5010 亿,激活 230 亿,使用 23.8 万亿 Token 预训练。在部分推理任务上,其算力效率接近 GLM-5.2 的四分之一到三分之一,但综合评分仍落后于 DeepSeek V4.1 Flash。
𝕏 ⭐ Google 发布 Nano Banana 2.1,出图价格砍半并提升主体一致性
Google 正式发布图像生成与编辑模型 Nano Banana 2.1,支持 4K 输出与蒙版编辑,最多可融合 14 张参考图,重点优化视觉设计与主体一致性能力,现已部署至 Gemini 应用及搜索 AI 模式。价格方面,1K 出图单价降至 $0.0336,约为此前的一半。
⭐ OpenAI 开放决策 API 公共测试版,支持图像输入快速决策
OpenAI 将 Decisions API 向公众开放测试,基于 GPT-6 Luna 模型,支持文本和图像输入生成结构化决策输出。定价为 $0.10/百万 输入 token,无输出 token 费用,旨在帮助应用快速处理视觉内容判断。
⭐ Perplexity 发布 pplx-embed-v2-late 双模型:0.6B 与 9B 参数版本
Perplexity AI 推出 pplx-embed-v2-late 系列嵌入模型,包含 0.6B 轻量版和 9B 高精度版。两者共享统一嵌入空间,支持文本、图像及 PDF 检索,9B 模型在 MADQA 基准测试中得分 92.4%。
⭐ 谷歌 SynthID AI 检测器全面开放,可识别多厂商生成内容
谷歌 宣布向全球开放 SynthID 检测器,用于识别由 AI 生成的照片、视频或音频。该工具通过嵌入不可见数字水印进行验证,可检测来自 OpenAI、英伟达、Kakao 等厂商的内容,目前仅支持英文版本。
⭐ Anthropic 技术负责人:蒸馏会毁掉前沿研发,中美 AI 竞赛不会暂停
Anthropic 技术负责人 Nicholas Marwell 和 Sholto Douglas 在播客中警告,模型蒸馏可能阻碍前沿研发。他们预测未来几年将出现 AGI,并强调中美之间的 AI 竞赛无法轻易暂停,同时讨论了失业、生物安全等风险。
OpenAI 在 ChatGPT 和 Codex 嵌入水印,首批针对欧盟用户
OpenAI 上线文本水印 textGrain,ChatGPT 与 Codex 欧盟用户优先启用,以符合 AI Act。
PFN 发布 PLaMo 3 Translate 31B 翻译模型
Preferred Networks 发布 PLaMo 3 Translate 31B,支持 53 种语言,每 10 万字符输入成本 14 日元,官方称四项权威基准平均分超 GPT-6.1Sol 与 GPT-6Astra,训练数据日语占比约 30%。
𝕏 vLLM v0.31.0 发布,支持 DeepSeek-V4.1-Flash
vLLM 发布 v0.31.0,含 717 个提交、307 位贡献者,支持 DeepSeek-V4.1-Flash 的 FlashMLA 与 NVFP4 KV 缓存,并新增预加载权重、推测解码等。
国庆七天 AI 圈密集发布:Claude Sonnet 5.5、GPT-6.1 Sol、Gemini 4 齐上阵
国庆期间 Anthropic 补齐全系 5.5 模型,OpenAI 发布 GPT-6.1 Sol 与常驻智能体 Dots,Google 放出 Gemini 4 Argon。
𝕏 Paradee-8M:8M 参数 CPU 实时语音模型发布
Paradee-8M v1.0 发布,仅 8M 参数,蒸馏自 Kokoro-82M,可在 CPU 单线程 实时运行且效果意外不错,仅支持英文。
EVENT-DRIVEN INTELLIGENCE
免费先跟踪重点,再决定是否升级
每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。