Qwen/Qwen3-4B
Модель text-generation · лицензия apache-2.0
Модель text-generation · лицензия apache-2.0
Модель fill-mask · лицензия mit
Модель image-text-to-text · лицензия apache-2.0
Модель text-generation · лицензия mit
Модель text-to-video · лицензия apache-2.0
Модель text-to-video · лицензия apache-2.0
Модель image-text-to-text · лицензия agpl-3.0
Модель text-generation · лицензия apache-2.0
Модель text-generation · лицензия other
Модель text-generation · лицензия other
Модель video-to-video · лицензия apache-2.0
Open-source платформа, ускоряющая донастройку больших языковых моделей с увеличением скорости до 32 раз и снижением потребления памяти.
Модель image-text-to-text · лицензия apache-2.0
Модель image-to-video · лицензия mit
Модель robotics · лицензия other
MIRA — world model с мультиплеером Французский стартап kyutai заколлабился с Epic Games и сделал нейронную версию игры
LTX-2.5 Обновился опенсорсный видеогенератор, на этот раз его назвали не только open-weights видео-, а еще и world мод
MIRA — world model с мультиплеером Французский стартап kyutai заколлабился с Epic Games и сделал нейронную версию игры
Вышла самая мощная в истории локальная LLM, которая запускается прямо на смартфоне — Bonsai 27B имеет 27 миллиардов (!)
Генеративный ИИ реально полезен. Странно, когда об этом говорит фаундер GenAI проектов 🤓 но все же. Вот кейс, что называ
️ SenseNova U1.5-Lite: не «умеет всё», а умеет делать всё вместе SenseNova выпустила U1.5-Lite - открытую мультимодаль
OpenGame: агент генерирует полноценные браузерные игры по текстовому описанию Исследователи из CUHK MMLab представили OpenGame — открытый агентный фреймворк для создания 2D-игр.
OpenGame: агент генерирует полноценные браузерные игры по текстовому описанию Исследователи из CUHK MMLab представили OpenGame — открытый агентный фреймворк для создания 2D-игр.
OpenSeeker-v2 : лучший в своем классе Deep Research агент, созданный академической командой всего на 10600 примерах Исследователи из Шанхайского университета Цзяо Тун представили OpenSeeker-v2 — агента, который самостоятельно исследует интернет в ответ на сложный вопрос: формулирует цепочку поисковых запросов, читает страницы, сопоставляет источники и выдаёт развёрнутый ответ.
OpenSeeker-v2 : лучший в своем классе Deep Research агент, созданный академической командой всего на 10600 примерах Исследователи из Шанхайского университета Цзяо Тун представили OpenSeeker-v2 — агента, который самостоятельно исследует интернет в ответ на сложный вопрос: формулирует цепочку поисковых запросов, читает страницы, сопоставляет источники и выдаёт развёрнутый ответ.
SenseNova-U1 : новая мультимодальная архитектура NEO-unify работает напрямую с пикселями без VAE Команда SenseNova представила мультимодальную архитектуру SenseNova-U1, которая объединяет понимание изображений, генерацию и редактирование внутри единого трансформера без VAE или визуального энкодера.
SenseNova-U1 : новая мультимодальная архитектура NEO-unify работает напрямую с пикселями без VAE Команда SenseNova представила мультимодальную архитектуру SenseNova-U1, которая объединяет понимание изображений, генерацию и редактирование внутри единого трансформера без VAE или визуального энкодера.
SenseNova-U1 : новая мультимодальная архитектура NEO-unify работает напрямую с пикселями без VAE Команда SenseNova представила мультимодальную архитектуру SenseNova-U1, которая объединяет понимание изображений, генерацию и редактирование внутри единого трансформера без VAE или визуального энкодера.
LongLive-2.0 — 5B-модель генерирует минутное видео в 720p в реальном времени Исследователи из NVIDIA опубликовали LongLive-2.0 — инфраструктуру для обучения и запуска моделей генерации длинных видео с использованием 4-битного квантования NVFP4.
LongLive-2.0 — 5B-модель генерирует минутное видео в 720p в реальном времени Исследователи из NVIDIA опубликовали LongLive-2.0 — инфраструктуру для обучения и запуска моделей генерации длинных видео с использованием 4-битного квантования NVFP4.
LLaVA-OneVision-2-8B : мультимодальная модель анализирует видеопоток через кодек вместо нарезки кадров Исследователи из Glint Lab, AIM for Health Lab и MVP Lab опубликовали LLaVA-OneVision-2 — мультимодальную модель нового поколения, которая переосмысливает то, как нейросеть «смотрит» видео.
LLaVA-OneVision-2-8B : мультимодальная модель анализирует видеопоток через кодек вместо нарезки кадров Исследователи из Glint Lab, AIM for Health Lab и MVP Lab опубликовали LLaVA-OneVision-2 — мультимодальную модель нового поколения, которая переосмысливает то, как нейросеть «смотрит» видео.
LLaVA-OneVision-2-8B : мультимодальная модель анализирует видеопоток через кодек вместо нарезки кадров Исследователи из Glint Lab, AIM for Health Lab и MVP Lab опубликовали LLaVA-OneVision-2 — мультимодальную модель нового поколения, которая переосмысливает то, как нейросеть «смотрит» видео.
ESM Cambrian : модель для предсказания и дизайна белков превзошла AlphaFold3 от Google и построила крупнейший атлас белкового мира Команда исследователей из Biohub представила ESM Cambrian (ESMC) — открытую языковую модель для предсказания и дизайна белков, которая обошла AlphaFold3 от Google по точности предсказания структур белка.
ESM Cambrian : модель для предсказания и дизайна белков превзошла AlphaFold3 от Google и построила крупнейший атлас белкового мира Команда исследователей из Biohub представила ESM Cambrian (ESMC) — открытую языковую модель для предсказания и дизайна белков, которая обошла AlphaFold3 от Google по точности предсказания структур белка.
DreamX-World-5B : открытая модель генерации мира с контролем камеры, текстовым управлением и запоминанием локаций Команда AMAP-ML опубликовала DreamX-World 1.0 — интерактивную генеративную модель мира, которая превращает текст или изображение в управляемое видео с точным контролем камеры, памятью о ранее посещённых сценах и поддержкой добавления событий по текстовым промптам.