天眼早报
🤖 AI 大模型
阿里开源 Qwen-Image-2.1:7B 参数,生成与编辑一体化
阿里千问开源 Qwen-Image-2.1,将文生图与图像编辑整合进同一模型,视觉生成部分仅 7B 参数,原生支持透明图像生成与编辑,最多可输入 10 张参考图;采用 qwen research license,vLLM 与 ComfyUI 均已实现首日支持,并适配 8 种芯片平台。
🏠 A20 Pro 实测:iPhone 18 Pro 本地跑 270 亿参数模型,速度翻倍
苹果 A20 Pro 搭载双 16 核神经引擎,iPhone 18 Pro 本地运行 270 亿参数的 Bonsai-27B 模型速度达 iPhone 17 Pro 两倍,配 12GB LPDDR5X、内存带宽 115.2GB/s。
Jev 模型发布:不做自然语言生成的结构化决策模型
TypeSafe AI 于 9 月 15 日正式发布 Jev,定位首个 System One Model:输入非结构化状态加类型化问题,输出严格枚举/布尔/联合类型,原生返回概率与置信度,定价每十亿 input token 42 美元;其三层架构由 LLM 层、负责模糊但有界语义决策的 Jev 层,以及保留文件权限、花费上限、工具白名单等硬约束的确定性代码层组成。
𝕏 网易有道开源真流式语音识别模型 Confucius4-R2T2
网易有道开源真流式语音识别模型Confucius4-R2T2,采用 Stable Prefix 机制让已输出文字只增不改,平均延迟200-600 毫秒、可调范围80 毫秒至 2 秒,重点优化中文英文并支持日韩法德俄等多语言,还可预设热词。
𝕏 阿里 Qwen-Image 2.1 登陆 SGLang-Diffusion,单张 4090 可跑
SGLang-Diffusion 实现对 Qwen-Image 2.1 的 Day-0 支持:单张 RTX 4090 24GB 可在 18.7 秒生成 1024×1024 图像、21.7 秒完成图片编辑,峰值显存 22.7 GiB;RTX PRO 6000 96GB 上分别缩短至 8 秒和 9.6 秒。
𝕏 业内评价 Jev:泛化能力、命名与范式之争
研究者 Sebastian Raschka 认为 Jev 的突破在于泛化能力好,而非只是分类器,秘诀可能更多在数据而非训练算法;开发者 wey_gu 称其把决策与生成分离,开启由多个 Jev-like 模型组成子神经系统、由 frontier LLM 协调的新范式;LangChain 创始人 hwchase17 认为 Decision Model 是很好的命名,预计会有更多玩家入局;研究者 deliprao 则指出 Jev 的类型抽象与 8 个月前发布的 autorubric 高度相似。
中国电信推全栈国产模型,把 AI 办公搬到企业本地
报道称中国电信推出全栈国产模型方案,把AI 办公搬到企业本地部署,一张 3090 显卡即可运行。
Jev 模型创始人:下一个 AI 时代绝不是 Claude Code 时代
Jev 模型创始人、GPT-4/ChatGPT 论文共同作者 Diogo Almeida 表示,Claude Code 仍属 AI 辅助人类时代,下一个时代的关键是从 Assistance 走向 Automation。
𝕏 JevBench 基准发布:Jev 综合领先 GPT-5.6 Luna
新基准 JevBench 针对有界软件决策类工作负载,综合智能、校准、速度与成本打分;Jev 1.13.0 虽在难例准确率上低于 GPT-5.6 Luna,但凭借延迟与成本优势在综合分领先。
𝕏 Cognition 开源 Kev 决策模型,0.6B/4B/8B 三种参数
Cognition 团队开源 Kev 决策模型,基于 Qwen3 加 LoRA,Kev-8B 域外准确率 79.6%,消费级硬件可跑。
阶跃星辰发布旗舰基座模型 Step 5 Preview
阶跃星辰发布旗舰基座模型Step 5 Preview;有开发者评论称该模型表现尚可,但后训练校准仍有待改进。
𝕏 Jev 十大营销用例:从广告创意打分到购买信号检测
Jev在营销场景的 10 个用例:广告创意打分、社交帖子过滤、ICP 检测、购买信号检测、评论优先级、评测分析、网红匹配等批量重复决策。
APUS 开源国内首批 Jev 跨平台复现成果
中国人工智能企业APUS旗下 AI 实验室公布全球最早一批针对Jev的独立开源复现成果,实现国产模型秒级决策。
Jev 创始人:GPT 不知道也要硬答或源于 RLHF 训练目标
Diogo Almeida 称 ChatGPT 不知道也要硬答,可能源于 RLHF 训练目标让模型迎合人类偏好,倾向给出听起来像对的答案而非承认不知道。
DeepSeek V4.1 Flash 上线 Command Code,$60 额度再延 8 天
Command Code 将 DeepSeek V4.1 Flash 的 60 美元用量额度再延长 8 天,10 美元/月的 GOAT 套餐提供 15.4 万次请求、78 亿 tokens,社区称缓存命中率接近 99%。
Cline Desktop 上线首周承担超 6% 任务,限时免费提供 Kimi K3
Cline 桌面应用上线首周已承担超 6% 的任务,约一半来自新用户,官方同步限时免费提供 Kimi K3 模型。
𝕏 GLM 5.3 Flash、DeepSeek V4.1 Flash、Qwen 3.8 被指全面超越 10 个月前的前沿模型
开发者指出 GLM 5.3 Flash、DeepSeek V4.1 Flash、Qwen 3.8 Next Flash 及 Qwen 3.8 27B 在智力与能力上均已超过 2025 年底被视为前沿智能的模型。
EVENT-DRIVEN INTELLIGENCE
免费先跟踪重点,再决定是否升级
每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。