
СтатьяОткрытый материал
ML Intern собрал модель Qwen в 0,8B за $16 — она работает на CPU
Разработчик Hugging Face уменьшил промпт-райтер Qwen с 9B до 0,8B. Модель работает на CPU, весь проект обошёлся в $16. Разбираю, как устроен процесс и что можно забрать в свой пайплайн.
Читать