OpenAI GPT-5.6 Sol набрал 38.3% на ARC-AGI-3 в собственном API
OpenAI GPT-5.6 Sol набрал 38.3% на ARC-AGI-3 в собственном API
Кратко: Модель GPT-5.6 Sol от OpenAI показала результат 38.3% на тесте ARC-AGI-3. Этот показатель был достигнут при использовании собственного API OpenAI с сохранением рассуждений и сжатием контекста.
Что произошло
OpenAI протестировала свою новую модель GPT-5.6 Sol на бенчмарке ARC-AGI-3. Результат составил 38.3%. Для достижения этого показателя использовался собственный API OpenAI, который позволяет сохранять цепочки рассуждений и сжимать контекст.
Что изменилось по сравнению с предыдущей версией
Сравнение с предыдущими версиями GPT в открытых источниках не приводится. Однако стоит отметить, что ARC-AGI-3 считается сложным тестом на обобщение и адаптацию, и результат выше 30% является значимым для индустрии. Для контекста: более ранние модели, такие как GPT-4, на аналогичных тестах показывали значительно более низкие результаты без специальных доработок.
Цены и доступность
Информация о цене и дате выхода GPT-5.6 Sol не раскрывается. Модель доступна через собственный API OpenAI.
Почему это важно
Результат 38.3% на ARC-AGI-3 демонстрирует прогресс в области обобщения и адаптации моделей к новым задачам. Использование собственного API с сохранением рассуждений и сжатием контекста указывает на то, что OpenAI продолжает развивать инфраструктуру для более эффективного тестирования и применения моделей.
Для пользователей AI-Sphere
Пользователям AI-Sphere стоит обратить внимание на этот результат, так как он может свидетельствовать о скором появлении более мощных моделей в API OpenAI. Следите за обновлениями карточки модели на ai-sphere.ru.
Источники