W skrócie

  • Zespół Multiverse Computing opublikował metodę zwaną Quantization-Aware Healing na blogu Hugging Face 25 sierpnia.
  • Zmniejszyli model OpenAI GPT-OSS ze 120 miliardów parametrów do 60 miliardów i skompresowali jego pamięć do 4 bitów – a mała wersja pokonała pełnowymiarowy model, z którego została skopiowana, w 7 z 9 testów.
  • Sztuczka: naucz zmniejszony model od oryginalnej inteligentnej wersji, a nie od słabej pośredniej kopii.

>>>> alert gd2md-html: link do obrazu inline w wygenerowanym źródle i przechowuj obrazy na swoim serwerze. UWAGA: Obrazy w wyeksportowanym pliku zip z Dokumentów Google mogą nie pojawiać się w tej samej kolejności, co w dokumencie. Sprawdź obrazy!

----->

Zespół badaczy właśnie zbudował mniejszą, tańszą wersję dużego modelu AI. Mniejszy okazał się mądrzejszy niż wersja, z której został zmniejszony.

To nie powinno się zdarzyć.

To jak utrata mięśni i jednoczesne wzmocnienie. Ale grupa w Multiverse Computing twierdzi, że tak się stało, a powód mówi coś o tym, jak błędnie zmniejszaliśmy AI.