跳到正文
热点事件持续更新

小米发布 MiMo-V2.6 自我改进论文

1 篇报道1 个报道来源4 小时前更新

先了解这件事

AI 综述

2026年10月10日,据 X 平台用户 Rohan Paul 发帖称,小米发布了 MiMo-V2.6 论文《MiMo-V2.6: Scaling Reinforcement Learning Towards Self-Improvement》。该帖称,论文中 AI 承担了大部分训练循环:智能体构建任务、审核测试、给答案打分并查找作弊行为,人类只设定预算和规则。上述内容均来自该帖转述,报道未提供论文原文、实验数据或官方发布渠道等进一步信息,也未说明模型规模、训练成本或适用条件。截至该报道,事件进展仅停留在论文发布及方法概述层面,尚无后续跟进报道。早先报道称……,后续报道称……(本条为首次报道,暂无早先与后续报道可供对照)。

AI 根据报道生成 · 4 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月10日
  1. Rohan Paul
    小米发布 MiMo-V2.6 论文,用智能体参与自身训练循环

    小米发布 MiMo-V2.6 论文《MiMo-V2.6: Scaling Reinforcement Learning Towards Self-Improvement》,其中 AI 承担了大部分训练循环:智能体构建任务、审核测试、给答案打分并查找作弊行为,人类只设定预算和规则。

本事件热度走势

可比范围当前
9
可比范围峰值
1010月10日 13:00
近 24 小时变化
–

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。