mlllm.ioAI-новости и лаборатория проектов
AI-канал Telegram Threads GitHub

Локальная версия

AI-новости и разборы на русском.

Русская версия mlllm.io: AI-новости, разборы, медиа и источники.

6 новости · 3 разборы
Google works on Frozen v2 AI chip for Gemini: Report

Google встраивает архитектуру Gemini в кремний

Google разрабатывает специализированный чип Frozen v2, который интегрирует архитектуру Gemini непосредственно в аппаратное обеспечение для повышения энергоэффективности. Переход от универсальных ускорителей к «замороженной» архитектуре (model-in-silicon) может радикально снизить капитальные затраты на дата-центры и решить проблему дефицита вычислительных мощностей.

КороткоПодробноTelegram
Вечеринка Гига Фан — мероприятие Сбера для ML- и AI-инженеров | Сбер.Среда

Команда GigaChat зовёт на вечеринку для AI-разработчиков и исследователей 🎉

Сбер проводит неформальное мероприятие Giga Fun Party для ML- и AI-инженеров 29 июля в Москве. Формирование профессионального сообщества вокруг локальных LLM-решений и прямой доступ к инженерам, занимающимся alignment и подготовкой данных для высокопроизводительных моделей.

КороткоПодробноTelegram
MobileWan: Closing the Quality Gap for Mobile Video Diffusion (GitHub)

MobileWan: видеогенерация прямо на смартфоне

Qualcomm AI Research представила MobileWan — оптимизированную версию модели Wan2.2 5B для генерации видео на мобильных устройствах. Демонстрирует эффективность агрессивного прунинга и дистилляции для переноса DiT-моделей на edge-устройства.

КороткоПодробноTelegram
Teaser image demonstrating novel view synthesis

MetaView: высокоточный синтез новых ракурсов по одному фото

Представлен MetaView — диффузионный фреймворк для синтеза новых ракурсов (novel view synthesis) по одному изображению с сохранением метрического масштаба. MetaView решает критическую проблему несоответствия масштаба и геометрической неконсистентности при больших изменениях ракурса, объединяя мощь диффузионных моделей (MM-DiT) с точными геометрическими подсказками без необходимости тяжелой 3D-реконструкции.

КороткоПодробноTelegram
Concurrent Image Understanding and Generation: Self-Correcting Coupled Markov Jump Processes

Google DeepMind представила CO2Jump для совместной генерации текста и изображений

Исследователи из Google DeepMind разработали training-free сэмплер CO2Jump, который позволяет тексту и изображению динамически корректировать друг друга в процессе денойзинга. Предложен новый подход к мультимодальной генерации, решающий проблему рассинхронизации данных.

КороткоПодробноTelegram
Keeping teams on one AI harness

Управление AI-агентами через единый harness

Статья на Baselane предлагает использовать версионируемые манифесты harness.json для решения проблемы дрейфа конфигурации AI-агентов в командах. Переход от разрозненных инструкций к централизованному управлению через манифесты снижает операционные риски и повышает прозрачность использования AI в масштабах компании.

КороткоПодробноTelegram
Google works on Frozen v2 AI chip for Gemini: Report

Google планирует внедрить архитектуру Gemini непосредственно в кремний с помощью чипа Frozen v2

Google разрабатывает специализированный серверный ИИ-чип под кодовым названием Frozen v2, который будет частично интегрировать архитектуру Gemini непосредственно в кремний для многократного повышения энергоэффективности.

ПодробноКороткоTelegram
Вечеринка Гига Фан — мероприятие Сбера для ML- и AI-инженеров | Сбер.Среда

Команда GigaChat проводит Giga Fun Party для ML- и AI-инженеров

29 июля в Москве пройдет Giga Fun Party — мероприятие от команды GigaChat (Сбер), ориентированное на ML- и AI-инженеров. Вместо классических докладов — живое общение о будущем LLM, мультимодальности и агентных системах.

ПодробноКороткоTelegram