OpenAI odkryła, że włączenie zaledwie dwóch ustawień API API drastycznie poprawiło wynik GPT-5.6 na benchmarku ARC-AGI-3 - wyniki potroiły się. Zmiana dotyczyła dwóch kluczowych aspektów: utrzymania pełnych procesów rozumowania oraz włączenia mechanizmu kompakcji, który optymalizuje przesyłanie i przetwarzanie danych.

Benchmark ARC-AGI-3 mierzy ogólną zdolność rozumowania sztucznej inteligencji na zadaniach abstraktnych i logicznych. To jeden z najtrudniejszych testów dla współczesnych modeli, dlatego potrojenie wyniku jest wynikiem znaczącym. Zmiana nie wymagała przeuczonego modelu czy żadnych modyfikacji wewnątrz GPT-5.6, a jedynie prawidłowej konfiguracji sposobu działania interfejsu.

To odkrycie ma istotne implikacje dla użytkowników i deweloperów pracujących z modelami OpenAI. Sugeruje, że część potencjału drzemiącego w modelach może być uwalniana poprzez lepszą konfigurację, a nie wyłącznie poprzez szkolenie bardziej zaawansowanych wersji. Ustawienia te mogą zatem dostarczyć lepszych wyników w rzeczywistych aplikacjach bez dodatkowych kosztów obliczeniowych.