天眼早报
🤖 AI 大模型
𝕏 OpenAI 成立部署公司并收购 Tomoro,加速企业 AI 落地
OpenAI宣布推出新业务部门「OpenAI Deployment Company」,专注企业 AI 系统深度嵌入核心流程,并已同意收购 AI 咨询公司Tomoro。该部门初始资金超40 亿美元,由 OpenAI 控股,TPG 领投,合作方包括高盛、软银等。收购将带来约150 名工程师与部署专家。OpenAI 称目前超100 万家企业使用其产品,下一阶段竞争核心将从「使用 AI」转向「围绕 AI 重构组织」。
𝕏 Anthropic 推出 Claude Platform on AWS,支持规模化部署智能体
Anthropic正式宣布 Claude Platform 在 AWS 全面上线,提供 Managed Agents、代码执行及网络搜索功能。新服务由 Anthropic 运营,所有新功能与原生 API 同步发布,支持 AWS 认证与计费集成。
𝕏 MiniCPM-V4.6 开源:最小模型超越 Qwen3.5-0.8B
ModelScope发布MiniCPM-V4.6 1.3B,成为 MiniCPM-V 系列中最小模型,在 OCRBench、RefCOCO 等基准测试中超越Qwen3.5-0.8B。该模型专为边缘设备优化,视觉编码计算减少50%,支持**4×/16×**混合压缩模式,兼容 ms-swift、vLLM 等主流框架。在 Artificial Analysis Intelligence Index 基准测试中得分 13,已适配 iOS、Android 及 HarmonyOS。
𝕏 Artificial Analysis 发布 Coding Agent Index,Opus 4.7 领跑
Artificial Analysis发布首个 Coding Agent Index 基准,涵盖 SWE-Bench-Pro-Hard-AA 等 3 项核心测试。Opus 4.7 以 61 分领先,GPT-5.5 紧随其后。测试显示不同组合成本差异超 30 倍,最快任务耗时 6 分钟,最慢达 40 分钟。
𝕏 Qwen 发布 WebWorld 开源网页智能体模型系列
Qwen WebWorld包含8B/14B/32B模型与数据集,采用Apache 2.0许可,MiniWob++提升9.9%、WebArena 提升10.9%。
𝕏 DeepSeek V4 Pro 上线 Together AI,推理性能达 SOTA
DeepSeek V4 Pro正式接入Together AI服务器端,支持长上下文推理与代码生成。通过 KV 缓存、混合注意力等优化技术,实现高效服务,为开发者提供SOTA级编程体验。
𝕏 Cursor Bugbot 新增 effort 配置,高难度修复率提升 35%
Cursor推出Bugbot的 effort 级别自定义功能,用户可调整 PR 审查深度。数据显示,开启高 effort模式后,Bugbot 检测到的漏洞数量增加35%,且合并时解决率保持不变。
𝕏 Zed 发布 Zeta 2.1 编辑预测模型,输出 Token 减少 3 倍
Zed编辑器推出 Zeta 2.1 编辑预测模型,输出 Token 数量减少 3 倍,p50 预测速度提升 28%。该优化使服务器负载降低 30%,显著提升了代码补全的响应效率。
𝕏 Claw-Eval 智能体基准公布:小米 MiMo 两款模型进前三
Claw-Eval榜单显示MiMo-V2.5-Pro 1T居首、GLM5.1 754B第二,DeepSeek v4 flash 210B接近 4 倍规模模型。
𝕏 Unsloth 正式加入 PyTorch 生态系统
Unsloth宣布正式成为PyTorch生态系统项目,标志着其在高效微调领域的技术获得官方认可。开发者 Daniel Han 表示未来将有更多新功能发布,进一步降低大模型训练门槛。
𝕏 Qwen 3.6 27B 在单张 3090 上一次生成完整游戏
Qwen 3.6 27B Q4在3090上用16 分 41 秒生成 2411 行游戏代码。
EVENT-DRIVEN INTELLIGENCE
免费先跟踪重点,再决定是否升级
每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。