OpenAI представила флагманскую модель GPT-6 Astra, сопроводив анонс заявлением о наступлении эры искусственного общего интеллекта (AGI). Однако независимое тестирование компании Artificial Analysis показало, что новинка демонстрирует результаты на уровне предыдущей версии GPT-5.6 Sol и уступает текущим лидерам рынка — моделям Claude Fable 5.1 от Anthropic и Muse Spark 1.3 от Meta (деятельность компания запрещена на территории РФ). Президент компании Грег Брокман (Greg Brockman) обозначил амбициозные цели проекта, но объективные метрики пока не подтверждают качественный скачок в общем интеллекте системы.
В рейтинге Intelligence Index, оценивающем способности к математике, науке и работе с длинными документами, GPT-6 Astra набрала 61 балл. Это точно соответствует показателям предшественницы и на пять пунктов меньше, чем у Claude Fable 5.1. В специализированном тесте Coding Agent Index ситуация выглядит лучше: модель получила 67 баллов в среде Codex, сравнявшись с топовыми версиями конкурентов, хотя абсолютным лидером остается Fable 5.1 с результатом 70 баллов.
Ключевым изменением для разработчиков стал существенный рост стоимости использования API. Цена за миллион входных токенов увеличилась с $4 до $10, а за выходных — с $20 до $50. Одновременно модель стала значительно эффективнее расходовать ресурсы: для задач программирования ей требуется в три раза меньше токенов, чем GPT-5.6 Sol. Благодаря этому итоговая стоимость выполнения одной задачи в кодинге осталась сопоставимой с предыдущим поколением, несмотря на рост тарифов. Также заметный прогресс зафиксирован в снижении количества галлюцинаций. Их частота упала с 92% до 51% при одновременном росте точности ответов.
Обучение модели проходило на инфраструктуре дата-центра Stargate в Техасе с использованием более 100 тысяч графических процессоров.
