OpenAI утроила результаты GPT-5.6 в бенчмарке ARC-AGI-3 благодаря двум настройкам

OpenAI утроила результаты GPT-5.6 в бенчмарке ARC-AGI-3 благодаря двум настройкам
Суть улучшения заключается в двух ключевых настройках, которые были применены к API GPT-5.6. Эти настройки позволили модели значительно повысить свои показатели и эффективность. В частности, они способствовали сохранению рассуждений (retaining reasoning) и включению компактизации (enabling compaction).

Сохранение рассуждений, вероятно, означает, что модель стала лучше удерживать контекст и логические цепочки на протяжении более длительных или сложных задач, что критически важно для бенчмарков, требующих глубокого понимания и последовательного мышления, таких как ARC-AGI-3. Компактизация, в свою очередь, могла оптимизировать обработку данных или внутренние представления модели, сделав ее более эффективной и способной обрабатывать больший объем информации или выполнять задачи быстрее без потери качества.

Эти изменения не просто увеличили числовые показатели, но и, по всей видимости, улучшили фундаментальные способности модели к решению сложных задач, требующих когнитивных функций, близких к человеческим. Утроение результатов на таком требовательном бенчмарке, как ARC-AGI-3, является серьезным показателем прогресса в области ИИ.

Достижение OpenAI демонстрирует, как даже небольшие, но целенаправленные изменения в архитектуре или настройках API могут привести к экспоненциальному росту производительности передовых моделей ИИ. Это открывает новые перспективы для разработки еще более мощных и эффективных систем искусственного интеллекта, способных решать широкий круг задач.
Первоисточник openai.com
Есть похожая задача? Опишите ее своими словами — вернемся с предварительной оценкой. Это ни к чему не обязывает.
Написать в Telegram