Стартап PrismML смог сжать модель Qwen3.8 на 27 миллиардов параметров до 5,9 Гб
Стартап PrismML разработал технологию сжатия больших языковых моделей, позволяющую запускать мощные нейросети локально на смартфонах и ПК с минимальной потерей производительности.