idevender/loss-basis-adam
Внутренняя магия оптимизаторов и калибровочные симметрии. The Loss Does Not See the Basis, but Adam Does Devender Si
Внутренняя магия оптимизаторов и калибровочные симметрии. The Loss Does Not See the Basis, but Adam Does Devender Si
FP8 mixed precision — где и как DeepSeek снизили точность вычислений? В прошлом посте мы разобрали, как использование
Kandinsky 5.0 Video Lite — новая open source модель генерации видео 🎬 Мы выпускаем Kandinsky 5.0 Video Lite — первую м
Kandinsky 5.0 Video Lite — новая open source модель генерации видео 🎬 Мы выпускаем Kandinsky 5.0 Video Lite — первую м
️ У нашей конференции AI Journey в этом году появился специальный трек для всех, кто хочет послушать толковые технически
️ У нашей конференции AI Journey в этом году появился специальный трек для всех, кто хочет послушать толковые технически
️ У нашей конференции AI Journey в этом году появился специальный трек для всех, кто хочет послушать толковые технически
️ У нашей конференции AI Journey в этом году появился специальный трек для всех, кто хочет послушать толковые технически
️ У нашей конференции AI Journey в этом году появился специальный трек для всех, кто хочет послушать толковые технически
Ruff: современный и быстрый linter + formatter для Python Правила оформления кода закреплены в стандартах: какие нужны
Генерируем рабочий интерфейс по одному лишь скриншоту На GitHub у проекта уже больше 74 тысяч звёзд. Превращаем скриншо
Учимся делать игры Нашёл открытый проект Godogen, который умеет генерировать полноценные игры. На GitHub у него уже бол
Сегодня радуюсь за своего друга Мишу Миша получил грант от Yandex Open Source за свой проект faster-coco-eval — ускоре
I've discovered a useful GitHub Actions plugin: lychee-action .
I've discovered a useful GitHub Actions plugin: lychee-action .
Добавляем субтитры к старым видео на YouTube.
Это была адская отладочная сессия, в которой огромную помощь оказал ИИ» , — Линус Торвальдс рассказал , как искал баг в графическом драйвере Intel Xe для Linux.
VocalNet: Speech LLM with Multi-Token Prediction for Faster and High-Quality Generation Multi-Token Prediction часто рассматривают как способ ускорить генерацию, но кроме этого он может улучшить её качество.
Сборники тестовых заданий и видео разборы реальных тестовых 👇 📦 Сборник тестовых заданий для Product Analyst и Data Analyst - задачи с реальных собеседований с решением, задачи разделены про грейдам, сферам компаний и тематикам: аб тесты, SQL, Python, логика и тд 📦 [eng/ru]Home assignments for data science positions - тестовые задания от разных компаний, на позицию, связанную с DS.
Qwen3-TTS Technical Report [2/2] Продолжаем обсуждать новинку от команды Alibaba.
Вас тоже бесит, когда приложение шлет рекламные пуши, но заблокировать их нельзя, потому что часть пушей от него необходимы (доставки, коды подтверждения и тд)?
AI + генетика - как я сделал своего личного генетического консультанта Несколько лет назад я сдал популярный генетический тест (~700 тысяч самых распространенных вариантов), супруга сделала секвенирование экзома (белок-кодирующая часть, ~1-2% генома, где сидит большинство известных мутаций), а дочке сделали полное секвенирование ДНК.
Даже если вы называете себя вайбкодером только в узком семейном кругу, чтобы окружающие не смеялись в лицо, но при этом активно используете ИИ-инструменты, вы все равно вайбкодер.
Даже если вы называете себя вайбкодером только в узком семейном кругу, чтобы окружающие не смеялись в лицо, но при этом активно используете ИИ-инструменты, вы все равно вайбкодер.
Даже если вы называете себя вайбкодером только в узком семейном кругу, чтобы окружающие не смеялись в лицо, но при этом активно используете ИИ-инструменты, вы все равно вайбкодер.
Даже если вы называете себя вайбкодером только в узком семейном кругу, чтобы окружающие не смеялись в лицо, но при этом активно используете ИИ-инструменты, вы все равно вайбкодер.
Даже если вы называете себя вайбкодером только в узком семейном кругу, чтобы окружающие не смеялись в лицо, но при этом активно используете ИИ-инструменты, вы все равно вайбкодер.
Даже если вы называете себя вайбкодером только в узком семейном кругу, чтобы окружающие не смеялись в лицо, но при этом активно используете ИИ-инструменты, вы все равно вайбкодер.
Даже если вы называете себя вайбкодером только в узком семейном кругу, чтобы окружающие не смеялись в лицо, но при этом активно используете ИИ-инструменты, вы все равно вайбкодер.
Забавно, как весь твиттер взбудоражился от новости, что Anthropic начал помечать невидимыми водяными знаками тексты, которые генерируют их модели.
Интересная штука вайбкодинг.
Маленький шаг в большом опенсорсе: добавили CVSS в Trivy Под капотом нашей AppSec-платформы в SourceCraft — крупный опенсорсный проект Trivy.
Маленький шаг в большом опенсорсе: добавили CVSS в Trivy Под капотом нашей AppSec-платформы в SourceCraft — крупный опенсорсный проект Trivy.
Ideogram v4 Fast , когда генерация картинок перестаёт быть “поставил и жди” fal выкатили ideogram-v4-fast на Hugging Face - ускоренную версию Ideogram 4, заточенную под быстрый FP4/NVFP4-инференс.
Поиск секретов в коде: новый инструмент и еще один способ На этот раз интересна даже не утилита , а подход, который можно применять для поиска аномалий в потоке данных.
The Stack v3 https://huggingface.co/datasets/HuggingFaceCode/stack-v3-train
Martian Code Review Bench https://codereview.withmartian.com/
Нас уже 800.
Мем дня На днях Дарио Амодеи (ceo оранжевых) заявил: Инженеры в Anthropic говорят: «Я больше не пишу код.
Хочу порекомендовать вам классное мероприятие , которое состоится онлайн 4 - 6 сентября.
Emu3.5: Native Multimodal Models are World Learners [ код и веса ] Emu3.5 представляет собой развитие идей предыдущих версий Emu, но с колоссальным скачком в масштабе и амбициях.
Emu3.5: Native Multimodal Models are World Learners [ код и веса ] Emu3.5 представляет собой развитие идей предыдущих версий Emu, но с колоссальным скачком в масштабе и амбициях.
Draw-In-Mind: Learning Precise Image Editing via Chain-of-Thought Imagination [ код, данные и веса обещают тут ] Yet another генеративка, обученная одновременно на T2I и instruction-based editing, уже не должна никого удивлять.
Nemotron-Labs-Diffusion: A Tri-Mode Language Model Unifying Autoregressive, Diffusion, and Self-Speculation Decoding [веса есть на HF ] NVIDIA выпустили большой техрепорт про диффузионные языковые модели.
LLaDA2.0-Uni: Unifying Multimodal Understanding and Generation with Diffusion Large Language Model [ код и веса ] Inclusion AI делает unified multimodal dLLM для understanding + generation.
DeepSeek V4 Pro внезапно стал заметно сильнее - без переобучения модели К DeepSeek V4 Pro 0813 подключили harness под
Наша команда вернулась с EMNLP 2025, на которой у нас было принято две статьи 🐫 Первая – Steering LLM Reasoning Throug
Давайте завайбкодим аналог Reddit r/place. Так как я большой адепт вайб-кодинга, у меня есть цель сделать так, чтобы м