Google встраивает архитектуру Gemini в кремний
Google разрабатывает специализированный чип Frozen v2, который интегрирует архитектуру Gemini непосредственно в аппаратное обеспечение для повышения энергоэффективности. Переход от универсальных ускорителей к «замороженной» архитектуре (model-in-silicon) может радикально снизить капитальные затраты на дата-центры и решить проблему дефицита вычислительных мощностей.
Команда GigaChat зовёт на вечеринку для AI-разработчиков и исследователей 🎉
Сбер проводит неформальное мероприятие Giga Fun Party для ML- и AI-инженеров 29 июля в Москве. Формирование профессионального сообщества вокруг локальных LLM-решений и прямой доступ к инженерам, занимающимся alignment и подготовкой данных для высокопроизводительных моделей.
MobileWan: видеогенерация прямо на смартфоне
Qualcomm AI Research представила MobileWan — оптимизированную версию модели Wan2.2 5B для генерации видео на мобильных устройствах. Демонстрирует эффективность агрессивного прунинга и дистилляции для переноса DiT-моделей на edge-устройства.
MetaView: высокоточный синтез новых ракурсов по одному фото
Представлен MetaView — диффузионный фреймворк для синтеза новых ракурсов (novel view synthesis) по одному изображению с сохранением метрического масштаба. MetaView решает критическую проблему несоответствия масштаба и геометрической неконсистентности при больших изменениях ракурса, объединяя мощь диффузионных моделей (MM-DiT) с точными геометрическими подсказками без необходимости тяжелой 3D-реконструкции.
Google DeepMind представила CO2Jump для совместной генерации текста и изображений
Исследователи из Google DeepMind разработали training-free сэмплер CO2Jump, который позволяет тексту и изображению динамически корректировать друг друга в процессе денойзинга. Предложен новый подход к мультимодальной генерации, решающий проблему рассинхронизации данных.
Управление AI-агентами через единый harness
Статья на Baselane предлагает использовать версионируемые манифесты harness.json для решения проблемы дрейфа конфигурации AI-агентов в командах. Переход от разрозненных инструкций к централизованному управлению через манифесты снижает операционные риски и повышает прозрачность использования AI в масштабах компании.
Google планирует внедрить архитектуру Gemini непосредственно в кремний с помощью чипа Frozen v2
Google разрабатывает специализированный серверный ИИ-чип под кодовым названием Frozen v2, который будет частично интегрировать архитектуру Gemini непосредственно в кремний для многократного повышения энергоэффективности.
Команда GigaChat проводит Giga Fun Party для ML- и AI-инженеров
29 июля в Москве пройдет Giga Fun Party — мероприятие от команды GigaChat (Сбер), ориентированное на ML- и AI-инженеров. Вместо классических докладов — живое общение о будущем LLM, мультимодальности и агентных системах.
MobileWan: Qualcomm переносит генерацию видео на мобильные устройства
Qualcomm AI Research представила MobileWan — оптимизированную версию модели Wan2.2 5B, которая позволяет генерировать видео высокого качества непосредственно на смартфонах.