news 2026/9/26 8:29:48

一周之内开源模型换了榜首:MiMo-V2.6-Pro 登顶、GLM-5.3-Flash 调用量第一,AI 进入「价格战 + 端侧」双线

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
一周之内开源模型换了榜首:MiMo-V2.6-Pro 登顶、GLM-5.3-Flash 调用量第一,AI 进入「价格战 + 端侧」双线

一周之内开源模型换了榜首:这份榜单变动,对做应用的人意味着什么

先把本周三个事实摆在前面(都可查原始来源):1.小米 MiMo-V2.6-Pro 登上开放权重(open-weights)模型第一。据 VentureBeat、TNW 等报道,这是一次公开直播的强化学习训练跑出来的模型,开放权重榜上超过此前的开源领头者;2.智谱 GLM-5.3-Flash 单日调用量增长超过七成,位列平台调用量第一,并引来马斯克的公开"点赞"(澎湃、新浪财经均有报道);3.闭源旗舰在同一天开始"降价提质":据 AI 行业日报汇总,OpenAI 推出轻量化旗舰并称 Token 价格减半、Anthropic 新旗舰推理成本较前代下降约 40%(注意:这一条来自行业汇总稿,官方口径请以各家公告为准)。单看每一条都是新闻;放在一起看,它们指向同一件事:模型的成本曲线在往下走,而且这次是开源侧领跑。## 一、小米这次"公开炼丹",真正值得注意的不是分数三个细节值得单独拎出来:-训练成本是有数的。关于这次强化学习训练的算力投入,不同来源口径不一致:有报道写262 万美元,也有汇总稿写350 万美元。这种"同一个项目两个价"很常见——算的是纯算力租用、还是含人力与数据,结论差一截。写文章时我把区间都留着,而不是挑一个更好看的数字。-过程是公开的。训练过程直播,意味着方法可复现的成分比"发布一个权重"更多。对中小团队来说,能抄的往往不是权重,而是训练流程与数据配比。-榜单分层要看清楚。开放权重榜(Open-Weights Index 之类)测的是开放权重模型之间的相对位置,不等于在你自己的任务上就能打赢闭源旗舰。榜单是筛子,不是判决书。## 二、调用量第一,比"榜单第一"更接近钱智谱这条的要害在调用量:单日增长七成、平台上排第一,说明有大量真实业务在跑,而不是只有评测分。一个模型被大规模调用,通常意味着三件事同时成立:够便宜、够稳、够好接。对开发者,这里有个反直觉的结论:跟进"被大量调用的模型",往往比跟进"分数最高的模型"更划算——因为生态(SDK、工具链、踩坑帖、供应商支持)是跟着调用量走的,出问题时你能搜到答案。## 三、别忽略第三条线:端侧同一周的另一个信号是端侧:有厂商发布的新一代移动芯片宣称可原生运行 300 亿参数级别的 MoE 模型,并配了常驻的小模型做本地感知(来源同为行业汇总,具体指标以厂商发布为准)。这条线的意义不在"手机跑大模型"这个口号,而在于任务分层:- 常驻的、隐私敏感的、要求毫秒响应的判断 → 放端侧;- 需要长上下文、复杂推理的 → 走云端;- 中间的胶水层(意图解析、格式转换、简单工具调用)→ 能用小模型就别用大模型。把这三层分开,成本往往比"换一个更便宜的模型"降得更多。## 四、这一周,做应用的人可以立刻做的三件事1)把"贵任务"和"便宜任务"分开记账。拿一周的真实日志,按调用点统计 Token 消耗,通常会发现 60%~80% 的花费集中在少数几个"长上下文 + 多轮"的调用点上。把这些点单独拎出来优化(缓存、截断、改成小模型),比整体换模型风险小得多。2)把提示缓存(prompt cache)真正用起来。多家都在强调缓存命中时的输入费用折扣(汇总稿里提到最高可到九成减免)。很多团队接了缓存 API 却没用上,原因通常是提示词前缀每次都在变(时间戳、随机 ID 混在系统提示里)——把不变的部分放前面、变化的部分挪到最后,命中率会立刻不一样。3)给"换模型"准备一条自己的小评测。不要用公开榜单决定选型。攒 30~50 条你自己的真实请求(含边界失败案例),写成一个能一键复跑的脚本,记录:准确率、平均延迟、单次成本。以后每次换模型,跑它一遍——这是团队里最便宜的"防跟风"机制。## 五、一点冷静的话这一周的新闻密度很高,但噪音也高:训练成本口径不一、榜单维度不同、“某某登顶"往往指某个特定榜单的特定指标。写这篇文章时我尽量把不确定的部分标出来,因为对读者真正有用的不是"谁第一”,而是**“这周之后,我的成本结构可以怎么改”**。模型会一直换榜首。能留下来的,是你自己那套评测、记账和分层的方法。—### 来源- VentureBeat:Xiaomi’s MiMo-V2.6-Pro debuts as the top open weights model- The Next Web:Xiaomi’s MiMo-V2.6 tops the open-weight rankings- Mixed-News:MiMo-V2.6-Pro tops open models after a $2.62m RL run- OrcaRouter:MiMo-V2.6-Pro 在 Open-Weights Index 上得分 46- 澎湃新闻:智谱 GLM-5.3-Flash 当日调用量增超七成,位列第一- 新浪财经:智谱,榜单登顶!马斯克"点赞"- CSDN《2026年9月23日AI行业日报》(闭源降价、算力基建、端侧芯片等汇总,文中已标注为汇总口径)> 说明:本文为公开信息二次整理,涉及第三方汇总的数字已标注来源与口径差异;不构成任何投资建议。

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/26 8:29:46

AgentScope实战:多智能体协作与RAG服务化落地

开篇:在AI应用开发里,我为什么推荐AgentScope如果你最近在折腾大模型应用,大概率已经感受过那种"单点Demo秒出、一上复杂场景就抓瞎"的憋屈感。调通一个ChatBot容易,但要做成"多个模型协同、既能检索知识库又能编排…

作者头像 李华
网站建设 2026/9/26 8:29:13

Java研发AI落地实战:Spring AI与RAG知识库从零搭建

1. 为什么 Java 研发现在必须重新理解 AI 落地过去一年半,我身边不少 Java 同行经历了从“看热闹”到“真焦虑”的转变。焦虑的点很具体:公司要求把大模型能力接进现有业务系统,但团队里没人知道从哪下手;网上教程一搜全是 Python…

作者头像 李华
网站建设 2026/9/26 8:29:10

Python爬虫与BeautifulSoup实战:NBA数据抓取指南

做NBA数据分析这段时间,我最大的感触是:真正难的不是后面跑模型、调参数,而是最开始能不能拿到一份干净、完整、让你放心往里灌的分析数据。很多人学Python数据分析,一上来就学pandas、matplotlib,结果真到自己动手做个…

作者头像 李华
网站建设 2026/9/26 8:27:45

AI代理人开发实战:用Prompt工程打造角色化仕女型C1

1. AI代理人是什么:从通用对话到角色化定制最近“AI代理人”这个词频繁出现在技术社区和产品发布会上。它和早期那种一问一答的聊天机器人有本质区别:传统聊天机器人只是被动地等你提问,AI代理人则更接近于一个具备自主对话风格、任务目标、记…

作者头像 李华
网站建设 2026/9/26 8:27:42

higgsfield:大模型RLHF训练框架的工程化实践与踩坑指南

一个叫“higgsfield”的仓库,我第一次看到这个名字时以为是物理学科的科普项目。毕竟希格斯场(Higgs Field)在物理里是赋予基本粒子质量的基础机制,这名字取得确实有学术味儿。点进去之后才发现,它其实是一个大模型高质…

作者头像 李华
网站建设 2026/9/26 8:27:41

Spring AI 2.x 集成 MCP 实战:stdio 与 SSE 文件工具调用全攻略

MCP 这个缩写今年在 AI 工程圈里出现频率有多高,不用我多说。Spring AI 2.x 已经把它当成一等公民来支持,但很多人按文档写完配置,MCP Server 也在日志里显示起来了,真让模型去调一次工具,却死活看不见实际效果——要么…

作者头像 李华