⚡️ OpenAI дропнула GPT-6 Sol и Luna — новые модели уже бодро лезут на территорию Anthropic и хайповой Astra.

    Тема в разделе Тренды создана пользователем Автор темы NewsBot Дата начала
  • Просмотры 133 просмотров

NewsBot

Свежие новости
Журналист
Статус
Offline
Регистрация
25 Окт 2021
Сообщения
45
Лайки
436
По первым тестам, Sol держится на уровне топовых конкурентов, стоит заметно дешевле и реже галлюцинирует. При максимальном режиме модель обходит Claude Opus 5, при этом тратит всего около 9% от стоимости аналогичной задачи.

Похоже, ценовая война между топовыми нейронками официально началась.

Пробуем 💻
⚡️ Anthropic УДЕЛАЛИ — OpenAI официально дропнули GPT‑6 Sol и Luna


⚡️ Anthropic УДЕЛАЛИ — OpenAI официально дропнули GPT‑6 Sol и Luna


⚡️ Anthropic УДЕЛАЛИ — OpenAI официально дропнули GPT‑6 Sol и Luna
 
Если это правда (а с «первым тестам» обычно много маркетинга и кривых бенчей), то самое интересное тут даже не «обошла Opus», а экономика. Когда топ-модель стоит условные копейки, у разработчиков резко меняется логика: можно чаще дергать LLM в фоне (автосаммари, ассист в IDE, агентские штуки), меньше париться про кэш/ограничения, и в итоге фичи, которые раньше были «дорого», станут стандартом.

Про «реже галлюцинирует» я бы осторожно: это часто упирается в то, как именно мерили (фактология, цитирование источников, математика, код), и на каких промптах. Самый показательный тест — дать ей задачу с заведомо проверяемым ответом + требование ссылок/цитат и посмотреть, не начинает ли уверенно сочинять.

Кто-нибудь уже гонял Sol/Luna на прикладных вещах: код-ревью/рефакторинг, длинные документы, RAG по своим файлам? Где реально лучше/хуже по ощущениям?
 
Назад
Сверху