Исследовательские и open-source AI-проекты, модели и исходники, которые можно изучать, запускать, дорабатывать и использовать в собственных решениях.
AnimeGANv2 — open-source модель для преобразования фото и видео в аниме-стиль с улучшенной четкостью арта. Сервис можно использовать для генерации иллюстраций, редактирования фото…
Подробнее о AnimeGANv2 →Тип проекта: Model
Направление: Vision
Язык: Python / PyTorch
Разработчик: TachibanaYoshino et al.
PaintsChainer — aI-инструмент для автоматической раскраски карандашных эскизов с возможностью выбора художественных стилей. Сервис можно использовать для генерации иллюстраций, ре…
Подробнее о PaintsChainer →Тип проекта: Research
Направление: Vision
Язык: Python / Chainer
Разработчик: PFN/Preferred Networks
GFPGAN — open-source модель для восстановления лиц на фото с использованием GAN (StyleGAN2), обеспечивает качественное восстановление. Сервис можно использовать для генерации иллю…
Подробнее о GFPGAN →Тип проекта: Model
Направление: Vision
Язык: Python / PyTorch
Разработчик: Tencent ARC / Xintao et al.
Avatarify — AI-инструмент для создания, редактирования или улучшения видео, разработанный alievk (open-source). По текущей карточке сервиса: Open-source софт для анимации лиц в ре…
Подробнее о Avatarify →Тип проекта: Demo
Направление: Vision / Video
Язык: Python
Разработчик: alievk (open‑source)
AnimateDiff — AI-инструмент для создания, редактирования или улучшения видео, разработанный Сообщество AnimateDiff. По текущей карточке сервиса: Open-source модель diffusion для г…
Подробнее о AnimateDiff →Тип проекта: Model
Направление: Video
Язык: Python / PyTorch
Разработчик: Сообщество AnimateDiff
Text2Video-Zero — AI-инструмент для создания, редактирования или улучшения видео, разработанный Picsart AI Research. По текущей карточке сервиса: Zero-shot генерация видео из текс…
Подробнее о Text2Video-Zero →Тип проекта: Research
Направление: Video
Язык: Python / PyTorch
Разработчик: Picsart AI Research
Mo-Cap Diffusion — AI-инструмент для исследований, анализа данных или технических задач, разработанный Guy Tevet и соавторы. По текущей карточке сервиса: AI-модель для дополнения …
Подробнее о Mo‑Cap Diffusion →Тип проекта: Research
Направление: Motion / 3D
Язык: Python / PyTorch
Разработчик: Guy Tevet и соавторы
DreamTalk — AI-инструмент для создания, редактирования или улучшения видео, разработанный ali-vilab / Ma et al.. По текущей карточке сервиса: Diffusion-модель audio-driven talking…
Подробнее о DreamTalk →Тип проекта: Research
Направление: Video / Audio
Язык: Python / PyTorch
Разработчик: ali‑vilab / Ma et al.
Vigogne — AI-инструмент для автоматизации контента, исследований или рабочих процессов, разработанный bofenghuang. По текущей карточке сервиса: Набор open-source LLM для français …
Подробнее о Vigogne →Тип проекта: Model
Направление: LLM
Язык: Python / PyTorch
Разработчик: bofenghuang
StyleGAN-V — AI-инструмент для создания, редактирования или улучшения видео, разработанный Ivan Skorokhodov, Sergey Tulyakov и соавторы. По текущей карточке сервиса: Continuous vi…
Подробнее о StyleGAN-V →Тип проекта: Research
Направление: Video
Язык: Python / PyTorch
Разработчик: Ivan Skorokhodov, Sergey Tulyakov и соавторы
VideoCrafter — AI-инструмент для создания, редактирования или улучшения видео, разработанный AILab-CVC / Tencent AI Lab. По текущей карточке сервиса: Open-source toolbox для Text2…
Подробнее о VideoCrafter →Тип проекта: Model
Направление: Video
Язык: Python / PyTorch
Разработчик: AILab‑CVC / Tencent AI Lab
Video Diffusion Models — исследовательская работа Jonathan Ho и соавторов о применении diffusion-моделей к генерации видео. Проект показывает, как расширить image diffusion archit…
Подробнее о Video Diffusion Models →Тип проекта: Research
Направление: Video
Язык: Python / JAX
Разработчик: Jonathan Ho et al.
Wan2.1 VACE — open-source video creation and editing framework от Alibaba TongYi Vision Intelligence Lab. Он объединяет генерацию и редактирование видео в единой diffusion-модели …
Подробнее о Wan2.1 VACE →Тип проекта: Model
Направление: Video
Язык: Python / PyTorch
Разработчик: Alibaba TongYi Vision Intelligence Lab
Zeroscope v2 — AI-инструмент для создания, редактирования или улучшения видео, разработанный Picsart AI Research / cerspense. По текущей карточке сервиса: Open-source zero-shot te…
Подробнее о Zeroscope v2 →Тип проекта: Model
Направление: Video
Язык: Python / PyTorch
Разработчик: Picsart AI Research / cerspense
Deforum — open-source расширение для AUTOMATIC1111 Stable Diffusion WebUI, которое создаёт AI-анимации и видео с управлением движением, ключевыми кадрами и параметрами генерации.
Подробнее о Deforum (Stable Diffusion) →Тип проекта: Repository
Направление: Video / Animation
Язык: Python
Лицензия: AGPL-3.0
Разработчик: Deforum
Galactica (Meta) — AI-инструмент от Meta AI, который решает специализированные задачи в своей нише. LLM от Meta для научных задач: обучен на миллионах статей, умеет резюмировать, …
Подробнее о Galactica (Meta) →Тип проекта: Model
Направление: LLM / Science
Язык: Python / PyTorch
Разработчик: Meta AI
ProGen (Salesforce) — AI-инструмент от Salesforce Research, который решает специализированные задачи в своей нише. LLM от Salesforce для генерации белков: обучена на >280 млн посл…
Подробнее о ProGen (Salesforce) →Тип проекта: Research
Направление: Biology / Protein
Язык: Python / PyTorch
Разработчик: Salesforce Research
MolGPT — AI-инструмент от Open-source community, который решает специализированные задачи в своей нише. Экспериментальный LLM для генерации SMILES и свойств молекул. Сервис полезе…
Подробнее о MolGPT →Тип проекта: Research
Направление: Chemistry / Molecules
Язык: Python / PyTorch
Разработчик: Open-source community
MelGAN — open-source GAN-модель для преобразования мел-спектрограмм в аудиосигнал, то есть нейросетевой vocoder для задач синтеза речи и звука. В отличие от consumer-сервисов, Mel…
Подробнее о MelGAN →Тип проекта: Research
Направление: Audio / Speech
Язык: Python / PyTorch
Разработчик: Kumar et al.
Dance Diffusion от Harmonai — open-source проект для генерации аудио с помощью diffusion-моделей. Он относится к исследовательскому направлению neural audio, где алгоритмы учатся …
Подробнее о Dance Diffusion (Harmonai) →Тип проекта: Research
Направление: Audio / Music
Язык: Python / PyTorch
Разработчик: Harmonai / Stability AI Lab
MuseGAN — open-source GAN-модель для многодорожечной полифонической генерации музыки. Она ориентирована на создание музыкальных последовательностей, где несколько инструментальных…
Подробнее о MuseGAN →Тип проекта: Research
Направление: Audio / Music
Язык: Python / TensorFlow
Разработчик: salu133445 et al.
MusicGen — аудио- и музыкальный AI-инструмент, связанный с направлением LLM, инструментал, текст‑в‑музыку. Музыкальная LLM от Meta, генерирует музыкальные композиции по текстовым …
Подробнее о MusicGen →Тип проекта: Model
Направление: Audio / Music
Язык: Python / PyTorch
Лицензия: MIT (code)
Разработчик: Meta
OpenBioLLM — семейство открытых медицинских LLM, созданное Saama AI Labs на базе Llama 3 для biomedical и clinical NLP-задач. Проект ориентирован на исследования и эксперименты с …
Подробнее о OpenBioLLM →Тип проекта: Model
Направление: Biomedical / LLM
Язык: Python / PyTorch
Разработчик: Saama AI Labs
LLaMA 3‑Instruct — универсальный AI-инструмент, связанный с направлением instruction‑tuned, dialogue, open-source. Instruction‑tuned версия LLaMA3 (8B и 70B) с улучшенными навыкам…
Подробнее о LLaMA 3‑Instruct →Тип проекта: Model
Направление: LLM
Язык: Python / PyTorch
Лицензия: Llama 3 Community License
Разработчик: Meta AI
Qwen‑Long (QwenLong‑L1‑32B) — универсальный AI-инструмент, связанный с направлением long‑context, MoE, document reasoning. Долгоконтекстный MoE‑LLM от Alibaba для reasoning на дли…
Подробнее о Qwen‑Long (QwenLong‑L1‑32B) →Тип проекта: Model
Направление: LLM / Long context
Язык: Python / PyTorch
Разработчик: Alibaba Cloud
OpenVoice — AI-инструмент или платформа в направлении voice cloning, open-source, TTS. Он закрывает озвучку, транскрибацию, синтез речи, обработку аудио или генерацию музыкальных …
Подробнее о OpenVoice →Тип проекта: Model
Направление: Audio / TTS
Язык: Python / PyTorch
Лицензия: MIT
Разработчик: MyShell AI
Bark — AI-инструмент или платформа в направлении TTS, open-source, AI voice. Он закрывает озвучку, транскрибацию, синтез речи, обработку аудио или генерацию музыкальных материалов…
Подробнее о Bark →Тип проекта: Model
Направление: Audio / TTS
Язык: Python / PyTorch
Лицензия: MIT
Разработчик: Suno AI
GPT-SoVITS — AI-инструмент или платформа в направлении voice cloning, TTS, open-source. Он закрывает озвучку, транскрибацию, синтез речи, обработку аудио или генерацию музыкальных…
Подробнее о GPT-SoVITS →Тип проекта: Repository
Направление: Audio / TTS
Язык: Python / PyTorch
Разработчик: Open Source
Demucs — AI-инструмент или платформа в направлении source separation, audio, open-source. Он закрывает озвучку, транскрибацию, синтез речи, обработку аудио или генерацию музыкальн…
Подробнее о Demucs →Тип проекта: Model
Направление: Audio / Music
Язык: Python / PyTorch
Разработчик: Meta AI Research
Segment Anything 2 (SAM 2) — модель Meta для promptable segmentation изображений и видео. Она переносит концепцию Segment Anything на видео, поддерживая интерактивное выделение и …
Подробнее о Segment Anything 2 →Тип проекта: Model
Направление: Vision / Video
Язык: Python / PyTorch
Лицензия: Apache-2.0
Разработчик: Meta AI / FAIR