• 552 млрд параметров всего, но активно юзает только 8 млрд на ввод и 16 млрд на генерацию. Экономия ресурсов без потери мозгов
  • KV Cache сокращен до 890 байт/токен — в 4 раза меньше прошлой версии. Длинные диалоги больше не жрут оперативку как не в себя
  • Мультимодальность из коробки: текст + изображения в одном окне, без костылей и сторонних сервисов
  • Контекст до 1 млн токенов — закидывай целые кодовые базы, книги или транскрипты подкастов
  • Настраиваемая глубина рассуждений от 1 до 100 — сам решаешь, насколько модель должна «думать» над ответом