Type

Tag “Stateoftheart” — 91

Qwen/Qwen3-4B

huggingface.co

Модель text-generation · лицензия apache-2.0

Model Models & platforms Web only

biohub/ESMC-6B

huggingface.co

Модель fill-mask · лицензия mit

Model Models & platforms Command line

PaddlePaddle/PaddleOCR-VL

huggingface.co

Модель image-text-to-text · лицензия apache-2.0

Model Models & platforms Self-hosted

zai-org/GLM-5-FP8

huggingface.co

Модель text-generation · лицензия mit

Model Models & platforms Web only

Wan-AI/Wan2.2-TI2V-5B

huggingface.co

Модель text-to-video · лицензия apache-2.0

Model Models & platforms Web only

Wan-AI/Wan2.1-T2V-1.3B

huggingface.co

Модель text-to-video · лицензия apache-2.0

Model Models & platforms Web only

Модель image-text-to-text · лицензия agpl-3.0

Model Models & platforms Web only

Модель text-generation · лицензия apache-2.0

Model Models & platforms Web only

LiquidAI/LFM2.5-230M

huggingface.co

Модель text-generation · лицензия other

Model Models & platforms Web only

Модель text-generation · лицензия other

Model Models & platforms Self-hosted

Модель video-to-video · лицензия apache-2.0

Model Models & platforms Web only

Unsloth AI

unsloth.ai

Open-source платформа, ускоряющая донастройку больших языковых моделей с увеличением скорости до 32 раз и снижением потребления памяти.

Model Coding & development Desktop

GD-ML/DreamX-World-5B

huggingface.co

Модель image-to-video · лицензия mit

Model Models & platforms Web only

H-EmbodVis/TurboVLA

huggingface.co

Модель robotics · лицензия other

Model Models & platforms Self-hosted

mira-wm.com

mira-wm.com

MIRA — world model с мультиплеером Французский стартап kyutai заколлабился с Epic Games и сделал нейронную версию игры

Tool Images Web only

ltx.io

ltx.io

LTX-2.5 Обновился опенсорсный видеогенератор, на этот раз его назвали не только open-weights видео-, а еще и world мод

Tool Images Web + desktop

mira-wm/mira

github.com

MIRA — world model с мультиплеером Французский стартап kyutai заколлабился с Epic Games и сделал нейронную версию игры

Tool Images Web only

Вышла самая мощная в истории локальная LLM, которая запускается прямо на смартфоне — Bonsai 27B имеет 27 миллиардов (!)

Tool AI agents

pexels.com

pexels.com

Генеративный ИИ реально полезен. Странно, когда об этом говорит фаундер GenAI проектов 🤓 но все же. Вот кейс, что называ

Tool Other Web only

️ SenseNova U1.5-Lite: не «умеет всё», а умеет делать всё вместе SenseNova выпустила U1.5-Lite - открытую мультимодаль

Tool Skills & prompts

leigest519/opengame

github.com

OpenGame: агент генерирует полноценные браузерные игры по текстовому описанию Исследователи из CUHK MMLab представили OpenGame — открытый агентный фреймворк для создания 2D-игр.

Tool Skills & prompts

opengame-project-page.com

opengame-project-page.com

OpenGame: агент генерирует полноценные браузерные игры по текстовому описанию Исследователи из CUHK MMLab представили OpenGame — открытый агентный фреймворк для создания 2D-игр.

Tool Skills & prompts

OpenSeeker-v2 : лучший в своем классе Deep Research агент, созданный академической командой всего на 10600 примерах Исследователи из Шанхайского университета Цзяо Тун представили OpenSeeker-v2 — агента, который самостоятельно исследует интернет в ответ на сложный вопрос: формулирует цепочку поисковых запросов, читает страницы, сопоставляет источники и выдаёт развёрнутый ответ.

Tool Directories & rankings

OpenSeeker-v2 : лучший в своем классе Deep Research агент, созданный академической командой всего на 10600 примерах Исследователи из Шанхайского университета Цзяо Тун представили OpenSeeker-v2 — агента, который самостоятельно исследует интернет в ответ на сложный вопрос: формулирует цепочку поисковых запросов, читает страницы, сопоставляет источники и выдаёт развёрнутый ответ.

Tool Directories & rankings

SenseNova-U1 : новая мультимодальная архитектура NEO-unify работает напрямую с пикселями без VAE Команда SenseNova представила мультимодальную архитектуру SenseNova-U1, которая объединяет понимание изображений, генерацию и редактирование внутри единого трансформера без VAE или визуального энкодера.

Tool Images

SenseNova-U1 : новая мультимодальная архитектура NEO-unify работает напрямую с пикселями без VAE Команда SenseNova представила мультимодальную архитектуру SenseNova-U1, которая объединяет понимание изображений, генерацию и редактирование внутри единого трансформера без VAE или визуального энкодера.

Tool Images

SenseNova-U1 : новая мультимодальная архитектура NEO-unify работает напрямую с пикселями без VAE Команда SenseNova представила мультимодальную архитектуру SenseNova-U1, которая объединяет понимание изображений, генерацию и редактирование внутри единого трансформера без VAE или визуального энкодера.

Tool Images

nvlabs/longlive

github.com

LongLive-2.0 — 5B-модель генерирует минутное видео в 720p в реальном времени Исследователи из NVIDIA опубликовали LongLive-2.0 — инфраструктуру для обучения и запуска моделей генерации длинных видео с использованием 4-битного квантования NVFP4.

Tool Video

papers/2605.18739

huggingface.co

LongLive-2.0 — 5B-модель генерирует минутное видео в 720p в реальном времени Исследователи из NVIDIA опубликовали LongLive-2.0 — инфраструктуру для обучения и запуска моделей генерации длинных видео с использованием 4-битного квантования NVFP4.

Tool Video

LLaVA-OneVision-2-8B : мультимодальная модель анализирует видеопоток через кодек вместо нарезки кадров Исследователи из Glint Lab, AIM for Health Lab и MVP Lab опубликовали LLaVA-OneVision-2 — мультимодальную модель нового поколения, которая переосмысливает то, как нейросеть «смотрит» видео.

Tool Video

LLaVA-OneVision-2-8B : мультимодальная модель анализирует видеопоток через кодек вместо нарезки кадров Исследователи из Glint Lab, AIM for Health Lab и MVP Lab опубликовали LLaVA-OneVision-2 — мультимодальную модель нового поколения, которая переосмысливает то, как нейросеть «смотрит» видео.

Tool Video

LLaVA-OneVision-2-8B : мультимодальная модель анализирует видеопоток через кодек вместо нарезки кадров Исследователи из Glint Lab, AIM for Health Lab и MVP Lab опубликовали LLaVA-OneVision-2 — мультимодальную модель нового поколения, которая переосмысливает то, как нейросеть «смотрит» видео.

Tool Video

beam-labs/foldbench

github.com

ESM Cambrian : модель для предсказания и дизайна белков превзошла AlphaFold3 от Google и построила крупнейший атлас белкового мира Команда исследователей из Biohub представила ESM Cambrian (ESMC) — открытую языковую модель для предсказания и дизайна белков, которая обошла AlphaFold3 от Google по точности предсказания структур белка.

Tool Search & research

biohub/esm

github.com

ESM Cambrian : модель для предсказания и дизайна белков превзошла AlphaFold3 от Google и построила крупнейший атлас белкового мира Команда исследователей из Biohub представила ESM Cambrian (ESMC) — открытую языковую модель для предсказания и дизайна белков, которая обошла AlphaFold3 от Google по точности предсказания структур белка.

Tool Search & research

DreamX-World-5B : открытая модель генерации мира с контролем камеры, текстовым управлением и запоминанием локаций Команда AMAP-ML опубликовала DreamX-World 1.0 — интерактивную генеративную модель мира, которая превращает текст или изображение в управляемое видео с точным контролем камеры, памятью о ранее посещённых сценах и поддержкой добавления событий по текстовым промптам.

Tool Skills & prompts

Submit a site to the catalog

Just send the link — we will work out the rest.

We will review what you send and add it to the catalog if it fits.