小米新AI模型MiMo-V2.6-Pro成本仅262万美元位居榜首
小米最近推出的MiMo-V2.6系列中,旗舰型号MiMo-V2.6-Pro在公开的AI模型中名列第一,每次任务的成本仅占竞争对手的一小部分。此次性能大幅提升得益于强化学习的扩展,但也引发了对其借用第三方技术的争议。根据小米的介绍,MiMo-V2.6-Pro在Artificial Analysis的智能指数中获得了46分,成为最强的公开可用AI模型,超越了Kimi K3和Qwen等竞争者。最为关键的是其低廉的使用费用:每百万输入token仅需0.435美元,输出token为0.87美元。Artificial Analysis估算,单个测试任务的成本大约为0.13美元,远低于同等能力模型的收费,使得该模型在智能与成本的平衡上表现出色。
MiMo-V2.6-Pro是一个拥有1.02万亿参数的混合专家模型,每次请求激活420亿参数。与此同时,小米还发布了一个更小型但高效的型号MiMo-V2.6-Flash。性能提升主要得益于强化学习的应用,小米通过更多的数据、任务环境和算力来进行训练。Pro模型的训练时间不到六天,耗资约262万美元,Flash模型则耗资约85万美元。在DeepSWE编程测试中,Pro的分数显著提升,从58.4提升至72.6,而Flash的分数从48.8升至65.7。
为了保证训练的稳定性,小米冻结了模型内部的概率分布机制,并建立了多层防护措施以防止“奖励黑客”现象,即模型通过不正当手段获取奖励。除此之外,小米还推出了一个名为Pro-UltraSpeed的变体,其输出速度可达前者的20倍。同时,小米开放了其强化学习工具包,包含技术报告、完整的训练框架、一个小型模型及大约7000个训练任务,其中涵盖软件开发、网络安全、办公工作和网页设计的自动评分任务,另有约1000个音乐创作任务,这些任务来源多样,部分源于员工真实的代码及用户查询。 球友会
小米的开放姿态与Anthropic的指控形成鲜明对比,后者在其威胁情报报告中提到,包括小米在内的多个中国实验室涉嫌非法蒸馏技术。Anthropic的调查显示,小米在2026年3至4月的20天内有超过40万次的交互取用Claude的能力,以丰富MiMo模型的训练数据。报告质疑小米在蒸馏过程中记录用户数据的合法性,暗示这些数据对其模型的成功发挥了关键作用。
斯坦丘或将重返罗马尼亚,克卢日大学传出签约消息
合理控制比赛节奏,进行有效的休息,及时补充水分。...
教育部赞扬13岁小将于子迪亚运夺金,推动更多孩子参与体育活动
合理控制比赛节奏,进行有效的休息,及时补充水分。...