Type

Tag “Stateoftheart” — 76

Helios: открытая 14B-модель генерирует видео длиной больше 60 секунд со скоростью 19,5 FPS на одной H100 Исследователи из Пекинского университета и ByteDance выпустили Helios — открытую 14B-модель, которая генерирует видео в реальном времени - 19,5 кадров в секунду, длительностью больше минуты.

Tool Images

Helios: открытая 14B-модель генерирует видео длиной больше 60 секунд со скоростью 19,5 FPS на одной H100 Исследователи из Пекинского университета и ByteDance выпустили Helios — открытую 14B-модель, которая генерирует видео в реальном времени - 19,5 кадров в секунду, длительностью больше минуты.

Tool Images

OpenClaw-RL: фреймворк обновляет веса агента на ходу, обучая его на реакциях пользователя и среды Исследователи из Princeton выпустили OpenClaw-RL — фреймворк, который дообучает агента в фоне, пока тот отвечает на запросы, без отдельного датасета и без ручной разметки.

Tool Agent frameworks

daVinci-MagiHuman: открытая модель генерирует видео с липсинком длиной 5 секунд за 2 секунды на одном H100 Команды SII-GAIR и Sand.ai опубликовали daVinci-MagiHuman — открытую мультимодальную 15B-модель на основе однопоточного трансформера, которая одновременно генерирует видео и синхронное аудио и создает 5-секундный клип в 256p за 2 секунды на одном GPU H100.

Tool Video

gair/davinci-magihuman

huggingface.co

daVinci-MagiHuman: открытая модель генерирует видео с липсинком длиной 5 секунд за 2 секунды на одном H100 Команды SII-GAIR и Sand.ai опубликовали daVinci-MagiHuman — открытую мультимодальную 15B-модель на основе однопоточного трансформера, которая одновременно генерирует видео и синхронное аудио и создает 5-секундный клип в 256p за 2 секунды на одном GPU H100.

Tool Video

daVinci-MagiHuman: открытая модель генерирует видео с липсинком длиной 5 секунд за 2 секунды на одном H100 Команды SII-GAIR и Sand.ai опубликовали daVinci-MagiHuman — открытую мультимодальную 15B-модель на основе однопоточного трансформера, которая одновременно генерирует видео и синхронное аудио и создает 5-секундный клип в 256p за 2 секунды на одном GPU H100.

Tool Video

MinerU-Diffusion : парсинг документов методом диффузии работает в 3.2 раза быстрее авторегрессивных моделей Команда Shanghai AI Lab и Пекинского университета представила MinerU-Diffusion — 2.5B-модель для парсинга документов, которая заменяет авторегрессивное декодирование параллельным диффузионным.

Tool Images

MinerU-Diffusion : парсинг документов методом диффузии работает в 3.2 раза быстрее авторегрессивных моделей Команда Shanghai AI Lab и Пекинского университета представила MinerU-Diffusion — 2.5B-модель для парсинга документов, которая заменяет авторегрессивное декодирование параллельным диффузионным.

Tool Images

MinerU-Diffusion : парсинг документов методом диффузии работает в 3.2 раза быстрее авторегрессивных моделей Команда Shanghai AI Lab и Пекинского университета представила MinerU-Diffusion — 2.5B-модель для парсинга документов, которая заменяет авторегрессивное декодирование параллельным диффузионным.

Tool Images

stepfun-ai/step1x-edit

huggingface.co

RealRestorer : открытая модель улучшения качества фото обогнала Nano Banana Pro на бенчмарке с реальными снимками Исследователи из StepFun и Китайской академии наук выпустили RealRestorer — открытую модель, которая убирает размытость, шум, дождь, дымку, муар, артефакты сжатия и засветку от объектива.

Tool Skills & prompts

RealRestorer : открытая модель улучшения качества фото обогнала Nano Banana Pro на бенчмарке с реальными снимками Исследователи из StepFun и Китайской академии наук выпустили RealRestorer — открытую модель, которая убирает размытость, шум, дождь, дымку, муар, артефакты сжатия и засветку от объектива.

Tool Skills & prompts

realrestorer/realrestorer

huggingface.co

RealRestorer : открытая модель улучшения качества фото обогнала Nano Banana Pro на бенчмарке с реальными снимками Исследователи из StepFun и Китайской академии наук выпустили RealRestorer — открытую модель, которая убирает размытость, шум, дождь, дымку, муар, артефакты сжатия и засветку от объектива.

Tool Skills & prompts

RealRestorer : открытая модель улучшения качества фото обогнала Nano Banana Pro на бенчмарке с реальными снимками Исследователи из StepFun и Китайской академии наук выпустили RealRestorer — открытую модель, которая убирает размытость, шум, дождь, дымку, муар, артефакты сжатия и засветку от объектива.

Tool Skills & prompts

ammmob/pixelsmile

github.com

PixelSmile : открытая модель для редактирования эмоций с плавным и точным контролем интенсивности Исследователи из Fudan University опубликовали PixelSmile — диффузионную модель для редактирования эмоций на фото и аниме.

Tool Directories & rankings

openrouter.ai

openrouter.ai

Trinity-Large-Thinking 400B : открытая модель показывает уровень Claude Opus-4.6 на агентных задачах и стоит в 28 раз дешевле Компания Arcee AI выложила в открытый доступ Trinity-Large-Thinking — модель с рассуждениями для сложных агентных задач.

Tool Directories & rankings

chat.arcee.ai

chat.arcee.ai

Trinity-Large-Thinking 400B : открытая модель показывает уровень Claude Opus-4.6 на агентных задачах и стоит в 28 раз дешевле Компания Arcee AI выложила в открытый доступ Trinity-Large-Thinking — модель с рассуждениями для сложных агентных задач.

Tool Directories & rankings

InCoder-32B-Thinking: открытая модель генерации кода для микроконтроллеров, оптимизации GPU-ядер и RTL-проектирования Команда из Пекинского авиационного института и других университетов опубликовала InCoder-32B-Thinking — открытую chain-of-thought модель для написания и отладки низкоуровневого кода на Verilog/RTL, CUDA, Triton и встраиваемом C.

Tool Directories & rankings

InCoder-32B-Thinking: открытая модель генерации кода для микроконтроллеров, оптимизации GPU-ядер и RTL-проектирования Команда из Пекинского авиационного института и других университетов опубликовала InCoder-32B-Thinking — открытую chain-of-thought модель для написания и отладки низкоуровневого кода на Verilog/RTL, CUDA, Triton и встраиваемом C.

Tool Directories & rankings

zju-real/clawgui

github.com

ClawGUI: фреймворк полного цикла для GUI-агентов от обучения до запуска на девайсе Исследователи из Чжэцзянского университета представили фреймворк для разработки GUI-агентов ClawGUI .

Tool Directories & rankings

sugarvapeur/clawgui-2b

huggingface.co

ClawGUI: фреймворк полного цикла для GUI-агентов от обучения до запуска на девайсе Исследователи из Чжэцзянского университета представили фреймворк для разработки GUI-агентов ClawGUI .

Tool Directories & rankings

nvlabs/qerl

github.com

QeRL — фреймворк для обучения моделей с подкреплением, который одновременно снижает требования к GPU и превосходит в точности традиционные методы LoRA и QLoRA.

Tool Directories & rankings

Ditto: открытый фреймворк для редактирования стиля и объектов на видео с 99% согласованностью кадров Ditto генерирует 5-секундные ролики с 20 FPS и разрешением 1280×720 по текстовым инструкциям с согласованными результатами по всем кадрам и точной модификацией целевых объектов.

Tool Agent frameworks

ali-vilab/vace

github.com

Ditto: открытый фреймворк для редактирования стиля и объектов на видео с 99% согласованностью кадров Ditto генерирует 5-секундные ролики с 20 FPS и разрешением 1280×720 по текстовым инструкциям с согласованными результатами по всем кадрам и точной модификацией целевых объектов.

Tool Agent frameworks

langmanbusi/insvie

github.com

Ditto: открытый фреймворк для редактирования стиля и объектов на видео с 99% согласованностью кадров Ditto генерирует 5-секундные ролики с 20 FPS и разрешением 1280×720 по текстовым инструкциям с согласованными результатами по всем кадрам и точной модификацией целевых объектов.

Tool Agent frameworks

editto.net

editto.net

Ditto: открытый фреймворк для редактирования стиля и объектов на видео с 99% согласованностью кадров Ditto генерирует 5-секундные ролики с 20 FPS и разрешением 1280×720 по текстовым инструкциям с согласованными результатами по всем кадрам и точной модификацией целевых объектов.

Tool Agent frameworks

ezioby/ditto

github.com

Ditto: открытый фреймворк для редактирования стиля и объектов на видео с 99% согласованностью кадров Ditto генерирует 5-секундные ролики с 20 FPS и разрешением 1280×720 по текстовым инструкциям с согласованными результатами по всем кадрам и точной модификацией целевых объектов.

Tool Agent frameworks

Ditto: открытый фреймворк для редактирования стиля и объектов на видео с 99% согласованностью кадров Ditto генерирует 5-секундные ролики с 20 FPS и разрешением 1280×720 по текстовым инструкциям с согласованными результатами по всем кадрам и точной модификацией целевых объектов.

Tool Agent frameworks

DeepEyesV2 — открытая агентная мультимодальная модель на базе Qwen2.5-VL-7B, которая умеет не просто понимать текст и изображения, но и активно использовать внешние инструменты.

Tool AI agents

DeepEyesV2 — открытая агентная мультимодальная модель на базе Qwen2.5-VL-7B, которая умеет не просто понимать текст и изображения, но и активно использовать внешние инструменты.

Tool AI agents

DeepEyesV2 — открытая агентная мультимодальная модель на базе Qwen2.5-VL-7B, которая умеет не просто понимать текст и изображения, но и активно использовать внешние инструменты.

Tool AI agents

DeepEyesV2 — открытая агентная мультимодальная модель на базе Qwen2.5-VL-7B, которая умеет не просто понимать текст и изображения, но и активно использовать внешние инструменты.

Tool AI agents

prime-rl/p1

github.com

Открытая модель впервые получила золотую медаль на Международной физической олимпиаде IPhO 2025 Модель P1-235B-A22B от Shanghai AI Laboratory стала первой открытой моделью, которая получила золотую медаль на IPhO 2025 — самой престижной физической олимпиаде в мире, где решение каждой задачи требует и аналитической точности, и творческого подхода.

Tool Agent frameworks

prime-rl/p1-235b-a22b

huggingface.co

Открытая модель впервые получила золотую медаль на Международной физической олимпиаде IPhO 2025 Модель P1-235B-A22B от Shanghai AI Laboratory стала первой открытой моделью, которая получила золотую медаль на IPhO 2025 — самой престижной физической олимпиаде в мире, где решение каждой задачи требует и аналитической точности, и творческого подхода.

Tool Agent frameworks

MiroThinker v1.0 : открытый ИИ-агент для исследований научился делать до 600 вызовов инструментов на задачу Исследователи опубликовали 3 модели на 8B, 30B и 72B параметров с контекстом 256К .

Tool Directories & rankings

MiroThinker v1.0 : открытый ИИ-агент для исследований научился делать до 600 вызовов инструментов на задачу Исследователи опубликовали 3 модели на 8B, 30B и 72B параметров с контекстом 256К .

Tool Directories & rankings

dr.miromind.ai

dr.miromind.ai

MiroThinker v1.0 : открытый ИИ-агент для исследований научился делать до 600 вызовов инструментов на задачу Исследователи опубликовали 3 модели на 8B, 30B и 72B параметров с контекстом 256К .

Tool Directories & rankings

Submit a site to the catalog

Just send the link — we will work out the rest.

We will review what you send and add it to the catalog if it fits.

Not sure how to implement it? We can help

Tell us about your task — we will pick the tools and suggest where to start.

0 / 5000
Verification code

Fields marked with an asterisk are required. Your data is used only to reply.