Тип

Тег «Stateoftheart» — 76

Helios: открытая 14B-модель генерирует видео длиной больше 60 секунд со скоростью 19,5 FPS на одной H100 Исследователи из Пекинского университета и ByteDance выпустили Helios — открытую 14B-модель, которая генерирует видео в реальном времени - 19,5 кадров в секунду, длительностью больше минуты.

Инструмент Изображения

Helios: открытая 14B-модель генерирует видео длиной больше 60 секунд со скоростью 19,5 FPS на одной H100 Исследователи из Пекинского университета и ByteDance выпустили Helios — открытую 14B-модель, которая генерирует видео в реальном времени - 19,5 кадров в секунду, длительностью больше минуты.

Инструмент Изображения

OpenClaw-RL: фреймворк обновляет веса агента на ходу, обучая его на реакциях пользователя и среды Исследователи из Princeton выпустили OpenClaw-RL — фреймворк, который дообучает агента в фоне, пока тот отвечает на запросы, без отдельного датасета и без ручной разметки.

Инструмент Фреймворки для агентов

daVinci-MagiHuman: открытая модель генерирует видео с липсинком длиной 5 секунд за 2 секунды на одном H100 Команды SII-GAIR и Sand.ai опубликовали daVinci-MagiHuman — открытую мультимодальную 15B-модель на основе однопоточного трансформера, которая одновременно генерирует видео и синхронное аудио и создает 5-секундный клип в 256p за 2 секунды на одном GPU H100.

Инструмент Видео

gair/davinci-magihuman

huggingface.co

daVinci-MagiHuman: открытая модель генерирует видео с липсинком длиной 5 секунд за 2 секунды на одном H100 Команды SII-GAIR и Sand.ai опубликовали daVinci-MagiHuman — открытую мультимодальную 15B-модель на основе однопоточного трансформера, которая одновременно генерирует видео и синхронное аудио и создает 5-секундный клип в 256p за 2 секунды на одном GPU H100.

Инструмент Видео

daVinci-MagiHuman: открытая модель генерирует видео с липсинком длиной 5 секунд за 2 секунды на одном H100 Команды SII-GAIR и Sand.ai опубликовали daVinci-MagiHuman — открытую мультимодальную 15B-модель на основе однопоточного трансформера, которая одновременно генерирует видео и синхронное аудио и создает 5-секундный клип в 256p за 2 секунды на одном GPU H100.

Инструмент Видео

MinerU-Diffusion : парсинг документов методом диффузии работает в 3.2 раза быстрее авторегрессивных моделей Команда Shanghai AI Lab и Пекинского университета представила MinerU-Diffusion — 2.5B-модель для парсинга документов, которая заменяет авторегрессивное декодирование параллельным диффузионным.

Инструмент Изображения

MinerU-Diffusion : парсинг документов методом диффузии работает в 3.2 раза быстрее авторегрессивных моделей Команда Shanghai AI Lab и Пекинского университета представила MinerU-Diffusion — 2.5B-модель для парсинга документов, которая заменяет авторегрессивное декодирование параллельным диффузионным.

Инструмент Изображения

MinerU-Diffusion : парсинг документов методом диффузии работает в 3.2 раза быстрее авторегрессивных моделей Команда Shanghai AI Lab и Пекинского университета представила MinerU-Diffusion — 2.5B-модель для парсинга документов, которая заменяет авторегрессивное декодирование параллельным диффузионным.

Инструмент Изображения

stepfun-ai/step1x-edit

huggingface.co

RealRestorer : открытая модель улучшения качества фото обогнала Nano Banana Pro на бенчмарке с реальными снимками Исследователи из StepFun и Китайской академии наук выпустили RealRestorer — открытую модель, которая убирает размытость, шум, дождь, дымку, муар, артефакты сжатия и засветку от объектива.

Инструмент Скилы и промпты

RealRestorer : открытая модель улучшения качества фото обогнала Nano Banana Pro на бенчмарке с реальными снимками Исследователи из StepFun и Китайской академии наук выпустили RealRestorer — открытую модель, которая убирает размытость, шум, дождь, дымку, муар, артефакты сжатия и засветку от объектива.

Инструмент Скилы и промпты

realrestorer/realrestorer

huggingface.co

RealRestorer : открытая модель улучшения качества фото обогнала Nano Banana Pro на бенчмарке с реальными снимками Исследователи из StepFun и Китайской академии наук выпустили RealRestorer — открытую модель, которая убирает размытость, шум, дождь, дымку, муар, артефакты сжатия и засветку от объектива.

Инструмент Скилы и промпты

RealRestorer : открытая модель улучшения качества фото обогнала Nano Banana Pro на бенчмарке с реальными снимками Исследователи из StepFun и Китайской академии наук выпустили RealRestorer — открытую модель, которая убирает размытость, шум, дождь, дымку, муар, артефакты сжатия и засветку от объектива.

Инструмент Скилы и промпты

ammmob/pixelsmile

github.com

PixelSmile : открытая модель для редактирования эмоций с плавным и точным контролем интенсивности Исследователи из Fudan University опубликовали PixelSmile — диффузионную модель для редактирования эмоций на фото и аниме.

Инструмент Каталоги и рейтинги

openrouter.ai

openrouter.ai

Trinity-Large-Thinking 400B : открытая модель показывает уровень Claude Opus-4.6 на агентных задачах и стоит в 28 раз дешевле Компания Arcee AI выложила в открытый доступ Trinity-Large-Thinking — модель с рассуждениями для сложных агентных задач.

Инструмент Каталоги и рейтинги

chat.arcee.ai

chat.arcee.ai

Trinity-Large-Thinking 400B : открытая модель показывает уровень Claude Opus-4.6 на агентных задачах и стоит в 28 раз дешевле Компания Arcee AI выложила в открытый доступ Trinity-Large-Thinking — модель с рассуждениями для сложных агентных задач.

Инструмент Каталоги и рейтинги

InCoder-32B-Thinking: открытая модель генерации кода для микроконтроллеров, оптимизации GPU-ядер и RTL-проектирования Команда из Пекинского авиационного института и других университетов опубликовала InCoder-32B-Thinking — открытую chain-of-thought модель для написания и отладки низкоуровневого кода на Verilog/RTL, CUDA, Triton и встраиваемом C.

Инструмент Каталоги и рейтинги

InCoder-32B-Thinking: открытая модель генерации кода для микроконтроллеров, оптимизации GPU-ядер и RTL-проектирования Команда из Пекинского авиационного института и других университетов опубликовала InCoder-32B-Thinking — открытую chain-of-thought модель для написания и отладки низкоуровневого кода на Verilog/RTL, CUDA, Triton и встраиваемом C.

Инструмент Каталоги и рейтинги

zju-real/clawgui

github.com

ClawGUI: фреймворк полного цикла для GUI-агентов от обучения до запуска на девайсе Исследователи из Чжэцзянского университета представили фреймворк для разработки GUI-агентов ClawGUI .

Инструмент Каталоги и рейтинги

sugarvapeur/clawgui-2b

huggingface.co

ClawGUI: фреймворк полного цикла для GUI-агентов от обучения до запуска на девайсе Исследователи из Чжэцзянского университета представили фреймворк для разработки GUI-агентов ClawGUI .

Инструмент Каталоги и рейтинги

nvlabs/qerl

github.com

QeRL — фреймворк для обучения моделей с подкреплением, который одновременно снижает требования к GPU и превосходит в точности традиционные методы LoRA и QLoRA.

Инструмент Каталоги и рейтинги

Ditto: открытый фреймворк для редактирования стиля и объектов на видео с 99% согласованностью кадров Ditto генерирует 5-секундные ролики с 20 FPS и разрешением 1280×720 по текстовым инструкциям с согласованными результатами по всем кадрам и точной модификацией целевых объектов.

Инструмент Фреймворки для агентов

ali-vilab/vace

github.com

Ditto: открытый фреймворк для редактирования стиля и объектов на видео с 99% согласованностью кадров Ditto генерирует 5-секундные ролики с 20 FPS и разрешением 1280×720 по текстовым инструкциям с согласованными результатами по всем кадрам и точной модификацией целевых объектов.

Инструмент Фреймворки для агентов

langmanbusi/insvie

github.com

Ditto: открытый фреймворк для редактирования стиля и объектов на видео с 99% согласованностью кадров Ditto генерирует 5-секундные ролики с 20 FPS и разрешением 1280×720 по текстовым инструкциям с согласованными результатами по всем кадрам и точной модификацией целевых объектов.

Инструмент Фреймворки для агентов

editto.net

editto.net

Ditto: открытый фреймворк для редактирования стиля и объектов на видео с 99% согласованностью кадров Ditto генерирует 5-секундные ролики с 20 FPS и разрешением 1280×720 по текстовым инструкциям с согласованными результатами по всем кадрам и точной модификацией целевых объектов.

Инструмент Фреймворки для агентов

ezioby/ditto

github.com

Ditto: открытый фреймворк для редактирования стиля и объектов на видео с 99% согласованностью кадров Ditto генерирует 5-секундные ролики с 20 FPS и разрешением 1280×720 по текстовым инструкциям с согласованными результатами по всем кадрам и точной модификацией целевых объектов.

Инструмент Фреймворки для агентов

Ditto: открытый фреймворк для редактирования стиля и объектов на видео с 99% согласованностью кадров Ditto генерирует 5-секундные ролики с 20 FPS и разрешением 1280×720 по текстовым инструкциям с согласованными результатами по всем кадрам и точной модификацией целевых объектов.

Инструмент Фреймворки для агентов

DeepEyesV2 — открытая агентная мультимодальная модель на базе Qwen2.5-VL-7B, которая умеет не просто понимать текст и изображения, но и активно использовать внешние инструменты.

Инструмент AI-агенты

DeepEyesV2 — открытая агентная мультимодальная модель на базе Qwen2.5-VL-7B, которая умеет не просто понимать текст и изображения, но и активно использовать внешние инструменты.

Инструмент AI-агенты

DeepEyesV2 — открытая агентная мультимодальная модель на базе Qwen2.5-VL-7B, которая умеет не просто понимать текст и изображения, но и активно использовать внешние инструменты.

Инструмент AI-агенты

DeepEyesV2 — открытая агентная мультимодальная модель на базе Qwen2.5-VL-7B, которая умеет не просто понимать текст и изображения, но и активно использовать внешние инструменты.

Инструмент AI-агенты

prime-rl/p1

github.com

Открытая модель впервые получила золотую медаль на Международной физической олимпиаде IPhO 2025 Модель P1-235B-A22B от Shanghai AI Laboratory стала первой открытой моделью, которая получила золотую медаль на IPhO 2025 — самой престижной физической олимпиаде в мире, где решение каждой задачи требует и аналитической точности, и творческого подхода.

Инструмент Фреймворки для агентов

prime-rl/p1-235b-a22b

huggingface.co

Открытая модель впервые получила золотую медаль на Международной физической олимпиаде IPhO 2025 Модель P1-235B-A22B от Shanghai AI Laboratory стала первой открытой моделью, которая получила золотую медаль на IPhO 2025 — самой престижной физической олимпиаде в мире, где решение каждой задачи требует и аналитической точности, и творческого подхода.

Инструмент Фреймворки для агентов

MiroThinker v1.0 : открытый ИИ-агент для исследований научился делать до 600 вызовов инструментов на задачу Исследователи опубликовали 3 модели на 8B, 30B и 72B параметров с контекстом 256К .

Инструмент Каталоги и рейтинги

MiroThinker v1.0 : открытый ИИ-агент для исследований научился делать до 600 вызовов инструментов на задачу Исследователи опубликовали 3 модели на 8B, 30B и 72B параметров с контекстом 256К .

Инструмент Каталоги и рейтинги

dr.miromind.ai

dr.miromind.ai

MiroThinker v1.0 : открытый ИИ-агент для исследований научился делать до 600 вызовов инструментов на задачу Исследователи опубликовали 3 модели на 8B, 30B и 72B параметров с контекстом 256К .

Инструмент Каталоги и рейтинги

Предложить сайт в каталог

Пришлите ссылку — остальное мы выясним сами.

Мы рассмотрим, что вы прислали, и добавим в каталог, если подойдёт.

Не знаете, как внедрить? Мы поможем

Расскажите про задачу — подберём инструменты и подскажем, с чего начать.

0 / 5000
Проверочный код

Поля со звёздочкой обязательны. Данные используются только для ответа.