🤖 LLM на микроконтроллере за $8

Разработчик slvDev запустил языковую модель с 28,9 млн параметров на ESP32-S3. Благодаря методу Per-Layer Embeddings (адаптация идеи Google Gemma) основная часть параметров хранится во внешней Flash-памяти, что позволяет обойти ограничения SRAM. Скорость генерации составляет около 9,5 токенов в секунду.

🌍 Это открывает путь к внедрению автономных локальных LLM в сверхбюджетные IoT-устройства без необходимости подключения к облаку.

👤 Теперь даже простые и дешевые микроконтроллеры могут поддерживать базовые интеллектуальные функции, удешевляя создание умных гаджетов.

Источник 1: https://github.com/slvDev/esp32-ai