天眼晚报
🤖 AI 大模型
𝕏 Sakana AI 模型 Namazu 上线 OpenRouter 与 Vercel AI Gateway
Sakana AI的 Namazu 模型已在 OpenRouter 上线,并同步上架 Vercel AI Gateway,可通过 Vercel AI SDK 无缝集成到 Web 应用。该模型专精日语与商务场景,支持 Web 搜索、代码执行与日语商务推理,可直接在工作流中调用。
🟩 Roboflow 基准证明 GPT-5.6 Sol 为最强视觉模型,OpenRouter/Vercel 降价 50%
Roboflow 基准显示,GPT-5.6 Sol 是 OpenAI 发布过的最强视觉模型,在 OCR、文档理解等任务上超越专业模型。同时,OpenAI 在 OpenRouter 与 Vercel AI Gateway 上对 GPT-5.6 Sol 独家降价 50%。SemiAnalysis 认为这可能是营销策略,若 token 量翻倍将影响市场对 OAI 份额的认知。
𝕏 开发者实测 Grok 4.6 成交互式 Agent 首选,性价比突出
开发者称 Grok 4.6 速度快、智能几乎与 Fable 相当,价格远低于 Opus 5,适合 CLI 交互式 Agent;云端后台任务则可选用 Fable/Sol 等更强模型。
𝕏 Seedance 2.5 视频生成价格降至 0.06 美元/秒,较半年前降 4 倍
Seedance 2.5 视频生成价格降至 0.06 美元/秒(约 0.4 元/秒),相比半年前 Seedance 2.0 的 1.5 元/秒降价超 4 倍,开源模型 H3 推动行业降价。
𝕏 DeepSeek-V4 系列实行峰谷定价,高峰期价格翻倍
OpenRouter 详解 DeepSeek 的 峰谷定价 机制:DeepSeek-V4 系列今日起采用 峰谷定价,高峰期价格 翻倍,旨在引导非高峰时段调用以降低成本。平台会自动选择最优价格并适配本地时区。
𝕏 Qwen3.8-27B 本地模型获 Cline 称赞,RTX 5090 跑出 115 tokens/s
Qwen3.8-27B 本地模型在 27B 参数规模实现 前沿性能,获 Cline 官方认可。开发者实测在 RTX 5090 32GB 显卡上本地运行 Qwen3.8-27B,速度达 115 tokens/s;官方 BF16 权重约 55.6GB,无需量化即可单卡部署,将拓展更多应用场景。
𝕏 Claude Code 集成 Claude Design,支持可视化 UI 编辑
Claude Code 现已集成 Claude Design,可生成 UI 并 可视化编辑,对 Pencil 和 Paper 等工具构成压力。
🔶 OpenAI 推出 ChatGPT 青少年版
OpenAI宣布推出 ChatGPT 青少年版,若系统判断用户未满 18 岁 或自报 13-17 岁 将自动切换,为青少年提供更安全的 AI 对话环境。
𝕏 OpenRouter token 年消耗量增至 75 万亿
OpenRouter 的 token 使用量一年内从 3.73 万亿 增至 75 万亿,反映 AI 模型调用需求爆发式增长。
𝕏 千问 3.8 2.7B Agentic 超越 DeepSeek Pro,双显卡可本地部署
千问 3.8 2.7B 的 Agentic 能力已超过 DeepSeek Pro,两张显卡即可本地部署,实现无限 Token。
3D 台球生成对比:Claude 5 首轮完成度碾压国产模型
实测 Claude 5 首轮即可生成功能完整的 3D 台球 游戏,菜单与球袋建模远超 GLM 5.3、K3 等国产模型。
Anthropic 披露内部模型 Model 2,多项基准略超 Claude Mythos 5
Anthropic 在风险报告中披露内部模型 Model 2,多项基准略超 Claude Mythos 5,暂不对外发布。
𝕏 Gemini 3.7 Flash 在 SkillsBench 得 65.9 分排名第二
Gemini 3.7 Flash 在 SkillsBench 得 65.9 分 列第二,仅次于 Grok 4.5。
EVENT-DRIVEN INTELLIGENCE
免费先跟踪重点,再决定是否升级
每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。