Коротко

  • Команда Multiverse Computing опублікувала метод під назвою Quantization-Aware Healing у блозі Hugging Face 25 серпня.
  • Вони зменшили відкриту модель GPT-OSS від OpenAI зі 120 мільярдів параметрів до 60 мільярдів і стиснули її пам'ять до 4-біт — і мала версія перевершила повноякісну модель, з якої її скопіювали, у 7 з 9 тестів.
  • Секрет: навчати зменшену модель від оригінальної розумної версії, а не від слабкої проміжної копії.

>>>> gd2md-html alert: inline image link in generated source and store images to your server. NOTE: Images in exported zip file from Google Docs may not appear in the same order as they do in your doc. Please check the images!

----->

Команда дослідників щойно створила меншу, дешевшу версію великої моделі ШІ. Менша виявилася розумнішою за версію, з якої її зменшили.

Цього не повинно було статися.

Це як втратити м'язи і водночас стати сильнішим. Але група в Multiverse Computing каже, що це сталося, і причина вказує на те, що ми весь час неправильно зменшували ШІ.