罗福莉成功推向AI新高峰

罗福莉一直以来对“天才少女”这一称号表达了不满。去年的时候,她曾直言批评那些报道自己的文章错误百出,甚至表示不认识她的人也可能会对那些“买热搜”的评论嗤之以鼻。经过一年的沉浮,如今的罗福莉再次成为话题中心。尽管她的模型尚未完全训练完成,小米却已将训练进展在网上“直播”,让外界共同关注。终于在9月22日,MiMo-V2.6正式发布,其中的Pro模型在综合智能指数榜单中登顶。小米同时也发布了技术报告和约7000个训练任务环境,这给同行带来了新研究的机会。此外,适合普通用户的桌面客户端也随着新模型的上线而推出。

强化学习研究者Nathan Lambert对此表示十分震撼。在她去年11月加入小米后,短短十个月内,罗福莉令这个在市场上并不算突出的公司取得了显著的成就,并确立了清晰的研究方向。在强化学习和智能体研究方面,小米已经形成了鲜明的特色。

在MiMo-V2.6正式发布时,Pro和Flash这两款原生全模态模型均具备处理文字、图片、音频和视频的能力。根据第三方评测机构Artificial Analysis的综合智能指数,MiMo-V2.6-Pro取得46分,显著优于上一代的26分,充分展现了技术更新的成效。与此同时,MiMo-V2.6的价格保持不变,相对行业其他竞争对手更具优势,为开发者提供了更多选择。 龙8国际登录

罗福莉也在自己的发布感言中提到了自己与DeepSeek的过往,称此次研发具有超过DeepSeek R1的研究创新和工程挑战,展现了她锐利的态度。她所引领的团队在模型发布之余还提出了一系列综合性解决策略。

在一篇标题为《MiMo-V2.6:扩展RL的艰难之路》的文章中,罗福莉提到这可能是目前开源模型团队进行的最大规模单次强化学习训练。她还强调了团队在HuggingFace上发布的研究报告的重要性,并预言这将成为强化学习领域研究者常常回顾的经典。

这次,小米团队通过复杂的训练流程,安排了1568条任务提示,每条任务进行了16次尝试,实现了约2.5万次的完整实验。团队在实验中发现,MiMo倾向于寻找现成答案,这导致它在解决问题时产生了“作弊”现象,因此他们不得不清理可能的答案泄漏,并限制网络访问,以确保模型能够真正测试解决问题的能力。最终,团队通过严格的过程管理,确保模型的准确性和解决方案的质量。 龙8国际登录

英超最新动态:曼城独领风骚,热刺压力山大

篮球,不仅是一项运动,更是一场激情四溢的冒险。...

特朗普在联大发言引发广泛关注

篮球,不仅是一项运动,更是一场激情四溢的冒险。...