OpenAI сообщила о выпуске новой модели искусственного интеллекта GPT-6 Astra, заявив, что это революционная система, а не рядовое обновление; президент компании Грег Брокман (Greg Brockman) даже намекнул на приход эры сильного ИИ (AGI), но независимое тестирование не показало в ней ничего выдающегося.

Содержание статьи
- 1 Снято в Голливуде? Почему Стэнли Кубрик физически не смог бы подделать лунную походку
- 2 Компьютер месяца, спецвыпуск: во что дефицит чипов памяти превратил бюджетные игровые ПК и при чем здесь Steam Machine
- 3 10 флагманских процессоров Intel за 10 лет
- 4 Обзор смартфона Samsung Galaxy Z Flip8: исчезающий вид?
- 5 Сравнительный тест камер флагманских смартфонов (2026): итоги
- 6 Топ-10 смартфонов до 10 тысяч рублей (2026 год)
- 7 Выбираем лучшие игровые ноутбуки на российском рынке (вторая половина 2026 года)
- 8 Лучший процессор под DDR4 в 2026 году: AM4 против LGA 1700
Снято в Голливуде? Почему Стэнли Кубрик физически не смог бы подделать лунную походку

Компьютер месяца, спецвыпуск: во что дефицит чипов памяти превратил бюджетные игровые ПК и при чем здесь Steam Machine

10 флагманских процессоров Intel за 10 лет

Обзор смартфона Samsung Galaxy Z Flip8: исчезающий вид?

Сравнительный тест камер флагманских смартфонов (2026): итоги

Топ-10 смартфонов до 10 тысяч рублей (2026 год)

Выбираем лучшие игровые ноутбуки на российском рынке (вторая половина 2026 года)

Лучший процессор под DDR4 в 2026 году: AM4 против LGA 1700

Источник изображения: Brecht Corbeel / unsplash.com
По результатам проведённой компанией Artificial Analysis серии тестов OpenAI GPT-6 Astra выступила на одном уровне со своей предшественницей, хуже ведущих моделей Anthropic и даже слабее вышедшей недавно Meta✴ Muse Spark 1.3. Artificial Analysis тестирует модели по единой открытой методологии без участия разработчиков и формирует на основе этих тестов рейтинги: Intelligence Index включает задачи по математике, естественнонаучным дисциплинам, программированию, анализу длинных документов и по фактическим знаниям; оценка Coding Agent Index отражает работу моделей в соответствующих агентских системах Codex, Claude Code или Muse Code. Регистрируются объёмы потребления токенов, стоимость задачи и скорость работы.
В Intelligence Index модель OpenAI GPT-6 Astra набрала 61 балл — столько же, сколько предыдущая GPT-5.6 Sol. Для сравнения, Anthropic Claude Fable 5.1 набрала 66 баллов, а Meta✴ Muse Spark 1.3 — 62 балла. В Coding Agent Index новая GPT-6 Astra в среде Codex показала 67 баллов, выступив примерно наравне с Claude Opus 5 и Fable 5 в Claude Code, а также Muse Spark 1.3 в Muse Code — лидерство сохранила Fable 5.1 в Claude Code с 70 баллами. По сравнению с GPT-5.6 Sol новая GPT-6 Astra подорожала в 2,5 раза: с $4 до $10 за 1 млн входных и с $20 до $50 за 1 млн выходных токенов; скидка на 90 % за чтение из кеша и надбавка на 25 % на запись в кеш остались прежними.

Источник изображения: artificialanalysis.ai
Рост цен компенсировал заметный скачок в эффективности токенов: GPT-6 Astra генерирует примерно треть от объёма GPT-5.6 Sol и примерно пятую часть от Claude Opus 5. При работе с программным кодом это значит, что при максимальных усилиях работа с ней обходится на уровне предшественницы, при этом новая модель оказывается на два пункта выше в рейтинге, а при равном показателе становится вдвое дешевле, чем Claude Fable 5. В Intelligence Index картина получается несколько иной: Astra экономит лишь 10 % выходных токенов по сравнению с предшественницей, лишь отчасти компенсируя разницу в цене; в расчёте на задачу она оказывается на 75 % дороже, чем Claude Fable 5.
Тест AA-Omniscience показал снижение частоты галлюцинаций с 92 % до 51 %. В тесте AA-Briefcase модель GPT-6 Astra стала лучше справляться с объёмными проектами, где задействуются тысячи исходных файлов, и прибавила около 80 баллов Elo, но по качеству презентаций работы она пока уступает GPT-5.6 Sol. А вот в тесте GDPval-AA v2 на практические задачи в 44 профессиях она, наоборот, потеряла 80 баллов Elo. В тесте Humanity’s Last Exam с акцентом на математику, написание кода и гуманитарные дисциплины модель прибавила шесть баллов; а также показала снижение на два–три балла в тестах τ³-Banking (поддержка клиентов), SciCode (задачи Python в естественнонаучной области) и AA-LCR (анализ больших документов).
Таким образом, новая OpenAI GPT-6 Astra стала выгоднее в задачах на написание кода, но пока не смогла побить конкурентов от Anthropic в области чистого интеллекта.
Было интересно?
Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект


