Тип

Тег «Stateoftheart» — 76

mira-wm.com

mira-wm.com

MIRA — world model с мультиплеером Французский стартап kyutai заколлабился с Epic Games и сделал нейронную версию игры

Инструмент Изображения Только веб

ltx.io

ltx.io

LTX-2.5 Обновился опенсорсный видеогенератор, на этот раз его назвали не только open-weights видео-, а еще и world мод

Инструмент Изображения Веб + десктоп

mira-wm/mira

github.com

MIRA — world model с мультиплеером Французский стартап kyutai заколлабился с Epic Games и сделал нейронную версию игры

Инструмент Изображения Только веб

Вышла самая мощная в истории локальная LLM, которая запускается прямо на смартфоне — Bonsai 27B имеет 27 миллиардов (!)

Инструмент AI-агенты

pexels.com

pexels.com

Генеративный ИИ реально полезен. Странно, когда об этом говорит фаундер GenAI проектов 🤓 но все же. Вот кейс, что называ

Инструмент Прочее Только веб

️ SenseNova U1.5-Lite: не «умеет всё», а умеет делать всё вместе SenseNova выпустила U1.5-Lite - открытую мультимодаль

Инструмент Скилы и промпты

leigest519/opengame

github.com

OpenGame: агент генерирует полноценные браузерные игры по текстовому описанию Исследователи из CUHK MMLab представили OpenGame — открытый агентный фреймворк для создания 2D-игр.

Инструмент Скилы и промпты

opengame-project-page.com

opengame-project-page.com

OpenGame: агент генерирует полноценные браузерные игры по текстовому описанию Исследователи из CUHK MMLab представили OpenGame — открытый агентный фреймворк для создания 2D-игр.

Инструмент Скилы и промпты

OpenSeeker-v2 : лучший в своем классе Deep Research агент, созданный академической командой всего на 10600 примерах Исследователи из Шанхайского университета Цзяо Тун представили OpenSeeker-v2 — агента, который самостоятельно исследует интернет в ответ на сложный вопрос: формулирует цепочку поисковых запросов, читает страницы, сопоставляет источники и выдаёт развёрнутый ответ.

Инструмент Каталоги и рейтинги

OpenSeeker-v2 : лучший в своем классе Deep Research агент, созданный академической командой всего на 10600 примерах Исследователи из Шанхайского университета Цзяо Тун представили OpenSeeker-v2 — агента, который самостоятельно исследует интернет в ответ на сложный вопрос: формулирует цепочку поисковых запросов, читает страницы, сопоставляет источники и выдаёт развёрнутый ответ.

Инструмент Каталоги и рейтинги

SenseNova-U1 : новая мультимодальная архитектура NEO-unify работает напрямую с пикселями без VAE Команда SenseNova представила мультимодальную архитектуру SenseNova-U1, которая объединяет понимание изображений, генерацию и редактирование внутри единого трансформера без VAE или визуального энкодера.

Инструмент Изображения

SenseNova-U1 : новая мультимодальная архитектура NEO-unify работает напрямую с пикселями без VAE Команда SenseNova представила мультимодальную архитектуру SenseNova-U1, которая объединяет понимание изображений, генерацию и редактирование внутри единого трансформера без VAE или визуального энкодера.

Инструмент Изображения

SenseNova-U1 : новая мультимодальная архитектура NEO-unify работает напрямую с пикселями без VAE Команда SenseNova представила мультимодальную архитектуру SenseNova-U1, которая объединяет понимание изображений, генерацию и редактирование внутри единого трансформера без VAE или визуального энкодера.

Инструмент Изображения

nvlabs/longlive

github.com

LongLive-2.0 — 5B-модель генерирует минутное видео в 720p в реальном времени Исследователи из NVIDIA опубликовали LongLive-2.0 — инфраструктуру для обучения и запуска моделей генерации длинных видео с использованием 4-битного квантования NVFP4.

Инструмент Видео

papers/2605.18739

huggingface.co

LongLive-2.0 — 5B-модель генерирует минутное видео в 720p в реальном времени Исследователи из NVIDIA опубликовали LongLive-2.0 — инфраструктуру для обучения и запуска моделей генерации длинных видео с использованием 4-битного квантования NVFP4.

Инструмент Видео

LLaVA-OneVision-2-8B : мультимодальная модель анализирует видеопоток через кодек вместо нарезки кадров Исследователи из Glint Lab, AIM for Health Lab и MVP Lab опубликовали LLaVA-OneVision-2 — мультимодальную модель нового поколения, которая переосмысливает то, как нейросеть «смотрит» видео.

Инструмент Видео

LLaVA-OneVision-2-8B : мультимодальная модель анализирует видеопоток через кодек вместо нарезки кадров Исследователи из Glint Lab, AIM for Health Lab и MVP Lab опубликовали LLaVA-OneVision-2 — мультимодальную модель нового поколения, которая переосмысливает то, как нейросеть «смотрит» видео.

Инструмент Видео

LLaVA-OneVision-2-8B : мультимодальная модель анализирует видеопоток через кодек вместо нарезки кадров Исследователи из Glint Lab, AIM for Health Lab и MVP Lab опубликовали LLaVA-OneVision-2 — мультимодальную модель нового поколения, которая переосмысливает то, как нейросеть «смотрит» видео.

Инструмент Видео

beam-labs/foldbench

github.com

ESM Cambrian : модель для предсказания и дизайна белков превзошла AlphaFold3 от Google и построила крупнейший атлас белкового мира Команда исследователей из Biohub представила ESM Cambrian (ESMC) — открытую языковую модель для предсказания и дизайна белков, которая обошла AlphaFold3 от Google по точности предсказания структур белка.

Инструмент Поиск и ресёрч

biohub/esm

github.com

ESM Cambrian : модель для предсказания и дизайна белков превзошла AlphaFold3 от Google и построила крупнейший атлас белкового мира Команда исследователей из Biohub представила ESM Cambrian (ESMC) — открытую языковую модель для предсказания и дизайна белков, которая обошла AlphaFold3 от Google по точности предсказания структур белка.

Инструмент Поиск и ресёрч

DreamX-World-5B : открытая модель генерации мира с контролем камеры, текстовым управлением и запоминанием локаций Команда AMAP-ML опубликовала DreamX-World 1.0 — интерактивную генеративную модель мира, которая превращает текст или изображение в управляемое видео с точным контролем камеры, памятью о ранее посещённых сценах и поддержкой добавления событий по текстовым промптам.

Инструмент Скилы и промпты

MIRA : нейросеть полностью симулирует Rocket League для четырёх игроков в 20 FPS, не требуя установки игры General Intuition, Kyutai и Epic Games представили MIRA — мировую модель, которая полностью симулирует игровую среду Rocket League сразу для четырёх игроков и рисует каждому свою картинку в реальном времени.

Инструмент Изображения

bitnet.live

bitnet.live

Bonsai : 1-bit версия Qwen 27B работает на iPhone c сохранением 90% качества ответов Стартап PrismML выпустил Bonsai 27B — бинарную и тернарную версии Qwen3.6-27B, которые сохраняют 90–95% качества исходной модели при сжатии весов в 9.4–14.2 раза.

Инструмент Изображения

Bonsai : 1-bit версия Qwen 27B работает на iPhone c сохранением 90% качества ответов Стартап PrismML выпустил Bonsai 27B — бинарную и тернарную версии Qwen3.6-27B, которые сохраняют 90–95% качества исходной модели при сжатии весов в 9.4–14.2 раза.

Инструмент Изображения

Bonsai : 1-bit версия Qwen 27B работает на iPhone c сохранением 90% качества ответов Стартап PrismML выпустил Bonsai 27B — бинарную и тернарную версии Qwen3.6-27B, которые сохраняют 90–95% качества исходной модели при сжатии весов в 9.4–14.2 раза.

Инструмент Изображения

TurboVLA: робот получает команды в разы быстрее при 97% успешных выполнений благодаря замене LLM на BERT Исследователи из Хуачжунского университета науки и технологий и Huawei опубликовали TurboVLA - компактную vision-language-action модель, которая выдаёт действия для робота за 31.2 мс на RTX 4090 и набирает 97.7% на бенчмарке для роботов LIBERO.

Инструмент Каталоги и рейтинги

robotwin-platform.github.io

robotwin-platform.github.io

TurboVLA: робот получает команды в разы быстрее при 97% успешных выполнений благодаря замене LLM на BERT Исследователи из Хуачжунского университета науки и технологий и Huawei опубликовали TurboVLA - компактную vision-language-action модель, которая выдаёт действия для робота за 31.2 мс на RTX 4090 и набирает 97.7% на бенчмарке для роботов LIBERO.

Инструмент Прочее

h-embodvis/turbovla

github.com

TurboVLA: робот получает команды в разы быстрее при 97% успешных выполнений благодаря замене LLM на BERT Исследователи из Хуачжунского университета науки и технологий и Huawei опубликовали TurboVLA - компактную vision-language-action модель, которая выдаёт действия для робота за 31.2 мс на RTX 4090 и набирает 97.7% на бенчмарке для роботов LIBERO.

Инструмент Каталоги и рейтинги

JoyAI-Video-Edit : 16B-модель редактирует видео в реальном времени при 30 FPS в 720p на одной B200 Команда Joy Future Academy представила JoyAI-Video-Edit — открытую авторегрессионную диффузионную модель на 16B параметров для редактирования видео в реальном времени.

Инструмент Скилы и промпты

4DAnyone : 4D-модель человека из видео, снятого одной камерой Исследователи из Zhejiang University, Robbyant, Ant Group и HKUST представили 4DAnyone - открытый фреймворк, который строит 4D-модель человека на основе видео, снятого с одной камеры.

Инструмент Фреймворки для агентов

️ 💊 Baichuan-M3: открытая медицинская модель ведет диалог как настоящий врач, обходя GPT-5.2-High и людей в точности диагностики Baichuan-M3 ведет себя как опытный терапевт — методично выясняет детали: когда именно началась боль, какого она характера, есть ли сопутствующие симптомы, какие лекарства принимались, были ли подобные эпизоды раньше.

Инструмент Изображения

️ 💊 Baichuan-M3: открытая медицинская модель ведет диалог как настоящий врач, обходя GPT-5.2-High и людей в точности диагностики Baichuan-M3 ведет себя как опытный терапевт — методично выясняет детали: когда именно началась боль, какого она характера, есть ли сопутствующие симптомы, какие лекарства принимались, были ли подобные эпизоды раньше.

Инструмент Изображения

zai-org/glm-5

github.com

GLM-5: топ-1 открытая модель для генерации кода и текста, конкурирующая с Claude и GPT на агентных задачах Zhipu AI опубликовали техрепорт GLM-5 — на сегодня лучшей открытой LLM в индексе Artificial Analysis и топ-1 в кодинге и тексте на LMArena , лидер на бенчмарках BrowseComp и HLE с инструментами среди всех моделей, включая закрытые.

Инструмент Каталоги и рейтинги

zai-org

huggingface.co

GLM-5: топ-1 открытая модель для генерации кода и текста, конкурирующая с Claude и GPT на агентных задачах Zhipu AI опубликовали техрепорт GLM-5 — на сегодня лучшей открытой LLM в индексе Artificial Analysis и топ-1 в кодинге и тексте на LMArena , лидер на бенчмарках BrowseComp и HLE с инструментами среди всех моделей, включая закрытые.

Инструмент Каталоги и рейтинги

wan-video/wan2.1

github.com

Helios: открытая 14B-модель генерирует видео длиной больше 60 секунд со скоростью 19,5 FPS на одной H100 Исследователи из Пекинского университета и ByteDance выпустили Helios — открытую 14B-модель, которая генерирует видео в реальном времени - 19,5 кадров в секунду, длительностью больше минуты.

Инструмент GitHub-проекты

Helios: открытая 14B-модель генерирует видео длиной больше 60 секунд со скоростью 19,5 FPS на одной H100 Исследователи из Пекинского университета и ByteDance выпустили Helios — открытую 14B-модель, которая генерирует видео в реальном времени - 19,5 кадров в секунду, длительностью больше минуты.

Инструмент Изображения

Предложить сайт в каталог

Пришлите ссылку — остальное мы выясним сами.

Мы рассмотрим, что вы прислали, и добавим в каталог, если подойдёт.

Не знаете, как внедрить? Мы поможем

Расскажите про задачу — подберём инструменты и подскажем, с чего начать.

0 / 5000
Проверочный код

Поля со звёздочкой обязательны. Данные используются только для ответа.