Xiaomi ворвалась в гонку ИИ и представила MiMo Code — новую модель уже называют потенциальным убийцей Claude.

    Тема в разделе Тренды создана пользователем Автор темы NewsBot Дата начала
  • Просмотры 203 просмотров

NewsBot

Свежие новости
Журналист
Статус
Offline
Регистрация
25 Окт 2021
Сообщения
368
Лайки
436
По заявлениям разработчиков, нейронка смогла обойти решения Anthropic сразу в трёх популярных бенчмарках. Среди главных фишек — практически безлимитный контекст, производительность на уровне Claude Sonnet 4.6 и способность переваривать огромные объёмы информации без заметной деградации качества ответов.

Если результаты подтвердятся в реальных задачах, на рынке ИИ станет ещё теснее, а конкуренция между гигантами выйдет на новый уровень.

Кажется, у Claude появился ещё один серьёзный сосед по общаге.

Тестим топ за свои деньги Для просмотра ссылки Войди или Зарегистрируйся.
Xiaomi выпустили убийцу Claude — MiMo Code, который обошел Anthropic в трех бенчмарках.
 
Вот это уже похоже на «рынок ИИ становится файтингом» ? Но я бы к таким заявлениям относился с лёгкой паранойей, пока не увижу живые кейсы от людей, а не только красивые цифры в бенчмарках.

Про “практически безлимитный контекст” — самая скользкая часть. Часто “безлимит” в маркетинге = либо сильно режут качество на длинных дистанциях, либо модель начинает «плыть» по фактам/инструкциям ближе к концу. Круто, если они реально решили проблему удержания требований и связности, а не просто научились принимать огромный инпут.

Обогнать Anthropic в 3 бенчмарках тоже надо расшифровывать:
  • какие именно бенчи (код? reasoning? агентские задачи?),
  • какие настройки (температура, тулзы, системный промпт),
  • и самое важное: не было ли “натаскивания на тесты” или совпадений по данным.

Если кто будет тестить по ссылке — предлагаю форумный «краш-тест», чтобы понять, не фейерверк ли это:
1) закинуть большой ТЗ/репу + попросить внести изменения по всему проекту (а не один файл),
2) дать длинную переписку с кучей требований и попросить сделать итоговый план, не потеряв ограничения,
3) “ядовитое” задание на внимательность: в середине контекста спрятать запрет/условие и посмотреть, соблюдает ли в конце.

Отпишитесь, кто уже прогнал: как с удержанием контекста на 100k+ токенов (или сколько там), и как по коду — меньше галлюцинаций, чем у Sonnet/ChatGPT, или всё как обычно?
 
Назад
Сверху