Roboflow
Комплексная платформа для компьютерного зрения, позволяющая разработчикам и компаниям создавать, обучать и развертывать кастомные AI-модели с оптимизированными рабочими процессами и масштабируемой инфраструктурой.
Комплексная платформа для компьютерного зрения, позволяющая разработчикам и компаниям создавать, обучать и развертывать кастомные AI-модели с оптимизированными рабочими процессами и масштабируемой инфраструктурой.
Комплексная AI-платформа, специализирующаяся на моделях YOLO для обнаружения объектов, сегментации и трекинга в реальном времени с простым обучением и развёртыванием.
Mochi 1 - бесплатная нейросеть для создания видео. Модель учитывает законы физики и генерирует видеоролики с последовательными кадрами и реалистичными эмоциями в разрешении 480p. Нейросеть можно загрузить со страницы проекта в GitHub, но для запуска потребуется 4 графических процессора H100.
Рабочее пространство для модного дизайна: создание концепций одежды, виртуальных визуалов и совместных коллекций.
Запускаем озвучку с AI даже на слабом компьютере @NeuroRazvedka Модель Soprano - позволяет генерировать качественну
Tencent открыла набор мультимодальных эмбеддингов Команда WeChat китайского техгиганта выложила в открытый доступ се
Tencent открыла набор мультимодальных эмбеддингов Команда WeChat китайского техгиганта выложила в открытый доступ се
Tencent открыла набор мультимодальных эмбеддингов Команда WeChat китайского техгиганта выложила в открытый доступ се
️ Один лайк — и ты в матрице: воркшоп по рекомендательным системам от Sber AI Lab Что будет, если научить AI не прост
Chandra — конвертируем PDF и любые изображения в полноценные документы. Лучшая в мире OCR-модель, которая аккуратно вы
Мы также выложили в открытый доступ наши новые вариационные автоэнкодеры K-VAE 1.0 ❓ О чём речь Генеративные модели,
дайджест Дайджест AI/ML за неделю 3–9 августа 2026 Alibaba: Wan 3.0 Омнимодальная видеомодель: на вход можно подават
дайджест Дайджест AI/ML за неделю 3–9 августа 2026 Alibaba: Wan 3.0 Омнимодальная видеомодель: на вход можно подават
дайджест Дайджест AI/ML за неделю 3–9 августа 2026 Alibaba: Wan 3.0 Омнимодальная видеомодель: на вход можно подават
FLUX 3D StyleGEN - нейросеть для создания 3D-изображений. Инструмент хорошо справляется с выполнением конкретных запросов, не добавляя лишних элементов. Нейросеть хорошо адаптируется к различным стилям, но лучшего всего получается фотореализм. Инструмент доступен на платформе Hugging Face.
StarVector - нейросеть для конвертации изображений в формат SVG. Как и любая модель из данной категории, она отлично справляется с простыми картинками, например, иконками, но испытывает проблемы с зашумленными и детализированными изображениями. Обе версии модели доступны бесплатно.
GLM-Image — нейросеть для генерации изображений от Zhipu AI. Эта модель с 16 миллиардами параметров безупречно работает с изображениями, в которых много текста: постерами, слайдами, инфографикой. Главное её преимущество — семантические токены, которые распознают не только цвет и форму, но и смысл: здесь лицо, а здесь шрифт.
GLM-Image: Auto-regressive for Dense-knowledge and High-fidelity Image Generation Продолжаем разбирать интересные авто
ВИДИМ ДАННЫЕ НАСКВОЗЬ 🤩 Даже хорошая рекомендательная модель может показать отличный результат на тесте, но провалитьс
MNIST 1D - самая прекрасно безумная работа, которую я пока увидел на ICML. Это полусинтетический датасет, похожий на MN
В опенсорс вышла самая точная нейронка для извлечения данных из любых документов — Lift от Datalab работает на уровне Ge
GHOST 2.0 — первая open source модель переноса головы от Sber AI 🥳 Мы с командой давно занимаемся задачей переноса лиц
GHOST 2.0 — первая open source модель переноса головы от Sber AI 🥳 Мы с командой давно занимаемся задачей переноса лиц
️ Коллеги из Центра Робототехники Сбера на этой неделе опубликовали техрепорт по Green-VLA . Это 4B staged v ision– l an