Naukowcy opracowali metodę QuIDE, która łączy kwantyzację modeli z aktywnym uczeniem się, aby znaleźć optymalny kompromis między rozmiarem sieci neuronowej a jej dokładnością. Problem, którym zajęli się badacze, dotyczy fundamentalnego wyzwania we wdrażaniu sztucznej inteligencji - modele muszą być możliwie małe, aby działać na zwykłych urządzeniach czy serwerach brzegowych, ale jednocześnie muszą zachować swoją skuteczność. QuIDE rozwiązuje tę sprzeczność poprzez inteligentny wybór danych treningowych, zamiast ślepo zmniejszać parametry modelu. To pozwala zaoszczędzić znaczące ilości zasobów obliczeniowych podczas procesu optymalizacji.
Kwantyzacja - czyli zmniejszanie precyzji liczb przechowywanych w sieci - to technologia znana od lat, ale wciąż stanowiąca złożony problem. Kiedy zmniejszamy bit-width reprezentacji liczb z 32 do 8 bitów, zyskujemy kompaktowy model, ale tracimy precyzję i dokładność. Podejście QuIDE zmienia perspektywę - zamiast polegać na arbitralnych wyborach dotyczących tego, które parametry skwantyzować i jak mocno, metoda wykorzystuje aktywne uczenie się, aby wybrać najkluczowsze próbki treningowe dla każdej fazy optymalizacji. To oznacza mniejszą liczbę iteracji, mniej zasobów obliczeniowych i ostatecznie lepsze wyniki.
Dla branży AI to wieść z dużym potencjałem praktycznym. Efektywniejsze modele to niższe koszty infrastruktury, szybsze działanie aplikacji na urządzeniach mobilnych i IoT, a także mniejszy ślad energetyczny całego procesu. QuIDE może przyspieszyć wdrażanie zaawansowanych modeli tam, gdzie dotychczas brakowało mocy obliczeniowej - od smartfonów po urządzenia przemysłowe. To szczególnie ważne w kontekście rosnących wymogów regulacyjnych dotyczących efektywności energetycznej AI.