天眼晚报
🤖 AI 大模型
𝕏 阿里巴巴发布 Qwen3.8-Max:2.4T 参数与 1M 上下文震撼登场
阿里巴巴正式发布 Qwen3.8-Max 模型,拥有 2.4T 参数和 1M 上下文窗口。基准测试显示其胜率超 96% 击败 Gemini 3.1 Pro,在 Text Arena 以 1496 分列第 5、医学领域第 1,Vision Arena第 2。该模型支持 10+ 天 自主代码开发及 500+ 轮 芯片设计优化,API 定价输入 $2/M tokens,输出 $6/M tokens。下周将开源权重版本,仅需 17GB 内存即可本地运行,是首个开源 Max 级大模型的国产模型。
𝕏 商汤科技开源 SenseNova U1.5-Lite:8B 模型实现 4K 图像生成
商汤科技开源轻量版 SenseNova U1.5-Lite,仅 8B 大小却支持 4K 图像生成与编辑。该模型在多项基准测试中超越原版 U1,甚至能比肩商用闭源模型,支持精准的文字与版式编辑,展现了极高的性价比与性能表现。
𝕏 MiniMax H3 全模态模型上线:33B 参数支持多模态视频生成
MiniMax推出 H3 模型,具备 33B 参数,由 33B 视频 Transformer 与 32B 文本视频编码器组成。模型已开源至 Hugging Face,支持文图音视统一输入,生成最高 2K 15 秒 带原生立体声视频,价格仅为同类 1/3。可在消费级 GPU 上通过 Diffusers 运行,支持文本转视频、图转视频及参考视频生成并带音频功能。
𝕏 DeepSeek V4 Flash High 登顶前端代码竞技场:成本全球最低
DeepSeek V4 Flash High在前端代码竞技场总分达 1586分,开源模型中排名第 3。相比预览版暴涨 154分,消费产品与参考设计均排第 6。研究机构测算,DeepSeek V4-Flash单任务成本约3 美分,仅为Claude Fable 5(3.15 美元)的1/105,刷新大模型性价比纪录。Cline已将 DeepSeek V4 Flash 免费额度提升3 倍,用户反馈实际表现优于预期。
𝕏 Kimi K3 系列本地部署突破:仅需 8.24GB 内存且接近 Claude Fable 5
Kimi K3模型可在仅 8.24GB内存的本地环境中运行,速度为 33 秒/Token。若升级至 128GB内存,推理速度可提升至 20 秒/Token。此外,Kimi K3 Max在 Pass@1 上接近Fable 5 xhigh,单次成本约1/3,每美元任务量高2.8 倍,展现了极强的本地化能力与性价比。
𝕏 xAI 开源内部 AI 编程工具 Grok Build:获 2.3 万 Star
xAI开源驱动Grok 4.5的终端 AI 编程 agent Grok Build,采用Apache 2.0协议,上线数小时获**2.3 万+**star,支持交互、无头脚本和编辑器嵌入三种模式,标志着其在开发者工具领域的重大进展。
𝕏 Sakana AI 推出日语特化 LLM API「Sakana Namazu」
Sakana AI发布日语特化 LLM API Sakana Namazu,基于开源模型并以内部数据强化日语业务适配,填补了特定语言场景下的模型空白。
EVENT-DRIVEN INTELLIGENCE
免费先跟踪重点,再决定是否升级
每篇公开内容都对应三步:订阅每日情报、查看同主题历史上下文、升级 Pro 解锁搜索、研究和事件详情。