05月12日 · 科技早报

天眼早报

科技|2026年05月12日|40 分钟阅读
来源:1154 条推文 + 214 篇 RSS 文章·Lanyun·BatchV2 生成·2026-05-11 — 2026-05-12
分享
AI 速读12 条精选

🤖 AI 大模型

𝕏 OpenAI 成立部署公司并收购 Tomoro,加速企业 AI 落地

OpenAI宣布推出新业务部门「OpenAI Deployment Company,专注企业 AI 系统深度嵌入核心流程,并已同意收购 AI 咨询公司Tomoro。该部门初始资金超40 亿美元,由 OpenAI 控股,TPG 领投,合作方包括高盛、软银等。收购将带来约150 名工程师与部署专家。OpenAI 称目前超100 万家企业使用其产品,下一阶段竞争核心将从「使用 AI」转向「围绕 AI 重构组织」。

𝕏 Anthropic 推出 Claude Platform on AWS,支持规模化部署智能体

Anthropic正式宣布 Claude PlatformAWS 全面上线,提供 Managed Agents、代码执行及网络搜索功能。新服务由 Anthropic 运营,所有新功能与原生 API 同步发布,支持 AWS 认证与计费集成。

𝕏 MiniCPM-V4.6 开源:最小模型超越 Qwen3.5-0.8B

ModelScope发布MiniCPM-V4.6 1.3B,成为 MiniCPM-V 系列中最小模型,在 OCRBench、RefCOCO 等基准测试中超越Qwen3.5-0.8B。该模型专为边缘设备优化,视觉编码计算减少50%,支持**4×/16×**混合压缩模式,兼容 ms-swift、vLLM 等主流框架。在 Artificial Analysis Intelligence Index 基准测试中得分 13,已适配 iOSAndroidHarmonyOS

𝕏 Artificial Analysis 发布 Coding Agent Index,Opus 4.7 领跑

Artificial Analysis发布首个 Coding Agent Index 基准,涵盖 SWE-Bench-Pro-Hard-AA3 项核心测试。Opus 4.761 分领先,GPT-5.5 紧随其后。测试显示不同组合成本差异超 30 倍,最快任务耗时 6 分钟,最慢达 40 分钟

𝕏 Qwen 发布 WebWorld 开源网页智能体模型系列

Qwen WebWorld包含8B/14B/32B模型与数据集,采用Apache 2.0许可,MiniWob++提升9.9%、WebArena 提升10.9%

𝕏 DeepSeek V4 Pro 上线 Together AI,推理性能达 SOTA

DeepSeek V4 Pro正式接入Together AI服务器端,支持长上下文推理与代码生成。通过 KV 缓存、混合注意力等优化技术,实现高效服务,为开发者提供SOTA级编程体验。

𝕏 Cursor Bugbot 新增 effort 配置,高难度修复率提升 35%

Cursor推出Bugbot的 effort 级别自定义功能,用户可调整 PR 审查深度。数据显示,开启高 effort模式后,Bugbot 检测到的漏洞数量增加35%,且合并时解决率保持不变。

𝕏 Zed 发布 Zeta 2.1 编辑预测模型,输出 Token 减少 3 倍

Zed编辑器推出 Zeta 2.1 编辑预测模型,输出 Token 数量减少 3 倍,p50 预测速度提升 28%。该优化使服务器负载降低 30%,显著提升了代码补全的响应效率。

𝕏 Claw-Eval 智能体基准公布:小米 MiMo 两款模型进前三

Claw-Eval榜单显示MiMo-V2.5-Pro 1T居首GLM5.1 754B第二,DeepSeek v4 flash 210B接近 4 倍规模模型。

𝕏 Unsloth 正式加入 PyTorch 生态系统

Unsloth宣布正式成为PyTorch生态系统项目,标志着其在高效微调领域的技术获得官方认可。开发者 Daniel Han 表示未来将有更多新功能发布,进一步降低大模型训练门槛。

𝕏 Qwen 3.6 27B 在单张 3090 上一次生成完整游戏

Qwen 3.6 27B Q43090上用16 分 41 秒生成 2411 行游戏代码


EVENT-DRIVEN INTELLIGENCE

免费先跟踪重点,再决定是否升级

每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。

分享

NEXT STEP · 留下邮箱

获取下一次重大事件提醒

每天一封精选情报,先用邮件建立复访,再决定是否升级到更深的追踪能力。