AI-проекты

Исследовательские и open-source AI-проекты, модели и исходники, которые можно изучать, запускать, дорабатывать и использовать в собственных решениях.

AnimeGANv2 logo

AnimeGANv2

AnimeGANv2 — open-source модель для преобразования фото и видео в аниме-стиль с улучшенной четкостью арта. Сервис можно использовать для генерации иллюстраций, редактирования фото…

Подробнее о AnimeGANv2 →
#open-source #аниме #видео‑стилизация

Тип проекта: Model

Направление: Vision

Язык: Python / PyTorch

Разработчик: TachibanaYoshino et al.

PaintsChainer logo

PaintsChainer

PaintsChainer — aI-инструмент для автоматической раскраски карандашных эскизов с возможностью выбора художественных стилей. Сервис можно использовать для генерации иллюстраций, ре…

Подробнее о PaintsChainer →
#раскраска #CNN #автоматизация

Тип проекта: Research

Направление: Vision

Язык: Python / Chainer

Разработчик: PFN/Preferred Networks

GFPGAN logo

GFPGAN

GFPGAN — open-source модель для восстановления лиц на фото с использованием GAN (StyleGAN2), обеспечивает качественное восстановление. Сервис можно использовать для генерации иллю…

Подробнее о GFPGAN →
#GAN #восстановление лиц #open-source

Тип проекта: Model

Направление: Vision

Язык: Python / PyTorch

Разработчик: Tencent ARC / Xintao et al.

Avatarify logo

Avatarify

Avatarify — AI-инструмент для создания, редактирования или улучшения видео, разработанный alievk (open-source). По текущей карточке сервиса: Open-source софт для анимации лиц в ре…

Подробнее о Avatarify →
#face animation #live avatar #open‑source

Тип проекта: Demo

Направление: Vision / Video

Язык: Python

Разработчик: alievk (open‑source)

AnimateDiff logo

AnimateDiff

AnimateDiff — AI-инструмент для создания, редактирования или улучшения видео, разработанный Сообщество AnimateDiff. По текущей карточке сервиса: Open-source модель diffusion для г…

Подробнее о AnimateDiff →
#diffusion model #video synthesis #open‑source

Тип проекта: Model

Направление: Video

Язык: Python / PyTorch

Разработчик: Сообщество AnimateDiff

Text2Video-Zero logo

Text2Video-Zero

Text2Video-Zero — AI-инструмент для создания, редактирования или улучшения видео, разработанный Picsart AI Research. По текущей карточке сервиса: Zero-shot генерация видео из текс…

Подробнее о Text2Video-Zero →
#text-to-video #zero-shot #diffusion

Тип проекта: Research

Направление: Video

Язык: Python / PyTorch

Разработчик: Picsart AI Research

Mo‑Cap Diffusion logo

Mo‑Cap Diffusion

Mo-Cap Diffusion — AI-инструмент для исследований, анализа данных или технических задач, разработанный Guy Tevet и соавторы. По текущей карточке сервиса: AI-модель для дополнения …

Подробнее о Mo‑Cap Diffusion →
#motion capture #diffusion #3d animation

Тип проекта: Research

Направление: Motion / 3D

Язык: Python / PyTorch

Разработчик: Guy Tevet и соавторы

DreamTalk logo

DreamTalk

DreamTalk — AI-инструмент для создания, редактирования или улучшения видео, разработанный ali-vilab / Ma et al.. По текущей карточке сервиса: Diffusion-модель audio-driven talking…

Подробнее о DreamTalk →
#talking head #audio-driven #diffusion

Тип проекта: Research

Направление: Video / Audio

Язык: Python / PyTorch

Разработчик: ali‑vilab / Ma et al.

Vigogne logo

Vigogne

Vigogne — AI-инструмент для автоматизации контента, исследований или рабочих процессов, разработанный bofenghuang. По текущей карточке сервиса: Набор open-source LLM для français …

Подробнее о Vigogne →
#LLM #French #instruction-following

Тип проекта: Model

Направление: LLM

Язык: Python / PyTorch

Разработчик: bofenghuang

StyleGAN-V logo

StyleGAN-V

StyleGAN-V — AI-инструмент для создания, редактирования или улучшения видео, разработанный Ivan Skorokhodov, Sergey Tulyakov и соавторы. По текущей карточке сервиса: Continuous vi…

Подробнее о StyleGAN-V →
#GAN #video generation #open‑source

Тип проекта: Research

Направление: Video

Язык: Python / PyTorch

Разработчик: Ivan Skorokhodov, Sergey Tulyakov и соавторы

VideoCrafter logo

VideoCrafter

VideoCrafter — AI-инструмент для создания, редактирования или улучшения видео, разработанный AILab-CVC / Tencent AI Lab. По текущей карточке сервиса: Open-source toolbox для Text2…

Подробнее о VideoCrafter →
#text-to-video #image-to-video #open‑source

Тип проекта: Model

Направление: Video

Язык: Python / PyTorch

Разработчик: AILab‑CVC / Tencent AI Lab

Video Diffusion Models logo

Video Diffusion Models

Video Diffusion Models — исследовательская работа Jonathan Ho и соавторов о применении diffusion-моделей к генерации видео. Проект показывает, как расширить image diffusion archit…

Подробнее о Video Diffusion Models →
#diffusion #video generation #research

Тип проекта: Research

Направление: Video

Язык: Python / JAX

Разработчик: Jonathan Ho et al.

Wan2.1 VACE logo

Wan2.1 VACE

Wan2.1 VACE — open-source video creation and editing framework от Alibaba TongYi Vision Intelligence Lab. Он объединяет генерацию и редактирование видео в единой diffusion-модели …

Подробнее о Wan2.1 VACE →
#video creation #editing #foundation model

Тип проекта: Model

Направление: Video

Язык: Python / PyTorch

Разработчик: Alibaba TongYi Vision Intelligence Lab

Zeroscope v2 logo

Zeroscope v2

Zeroscope v2 — AI-инструмент для создания, редактирования или улучшения видео, разработанный Picsart AI Research / cerspense. По текущей карточке сервиса: Open-source zero-shot te…

Подробнее о Zeroscope v2 →
#text-to-video #diffusion #open‑source

Тип проекта: Model

Направление: Video

Язык: Python / PyTorch

Разработчик: Picsart AI Research / cerspense

Deforum (Stable Diffusion) logo

Deforum (Stable Diffusion)

Deforum — open-source расширение для AUTOMATIC1111 Stable Diffusion WebUI, которое создаёт AI-анимации и видео с управлением движением, ключевыми кадрами и параметрами генерации.

Подробнее о Deforum (Stable Diffusion) →
#animation #video #Stable Diffusion #open-source

Тип проекта: Repository

Направление: Video / Animation

Язык: Python

Лицензия: AGPL-3.0

Разработчик: Deforum

Galactica (Meta) logo

Galactica (Meta)

Galactica (Meta) — AI-инструмент от Meta AI, который решает специализированные задачи в своей нише. LLM от Meta для научных задач: обучен на миллионах статей, умеет резюмировать, …

Подробнее о Galactica (Meta) →
#LLM #scientific text #open-source research

Тип проекта: Model

Направление: LLM / Science

Язык: Python / PyTorch

Разработчик: Meta AI

ProGen (Salesforce) logo

ProGen (Salesforce)

ProGen (Salesforce) — AI-инструмент от Salesforce Research, который решает специализированные задачи в своей нише. LLM от Salesforce для генерации белков: обучена на >280 млн посл…

Подробнее о ProGen (Salesforce) →
#protein design #LLM #bioengineering

Тип проекта: Research

Направление: Biology / Protein

Язык: Python / PyTorch

Разработчик: Salesforce Research

MolGPT logo

MolGPT

MolGPT — AI-инструмент от Open-source community, который решает специализированные задачи в своей нише. Экспериментальный LLM для генерации SMILES и свойств молекул. Сервис полезе…

Подробнее о MolGPT →
#molecular generation #LLM #SMILES

Тип проекта: Research

Направление: Chemistry / Molecules

Язык: Python / PyTorch

Разработчик: Open-source community

MelGAN logo

MelGAN

MelGAN — open-source GAN-модель для преобразования мел-спектрограмм в аудиосигнал, то есть нейросетевой vocoder для задач синтеза речи и звука. В отличие от consumer-сервисов, Mel…

Подробнее о MelGAN →
#voice synthesis #GAN #open-source

Тип проекта: Research

Направление: Audio / Speech

Язык: Python / PyTorch

Разработчик: Kumar et al.

Dance Diffusion (Harmonai) logo

Dance Diffusion (Harmonai)

Dance Diffusion от Harmonai — open-source проект для генерации аудио с помощью diffusion-моделей. Он относится к исследовательскому направлению neural audio, где алгоритмы учатся …

Подробнее о Dance Diffusion (Harmonai) →
#open-source #audio diffusion #Replicate

Тип проекта: Research

Направление: Audio / Music

Язык: Python / PyTorch

Разработчик: Harmonai / Stability AI Lab

MuseGAN logo

MuseGAN

MuseGAN — open-source GAN-модель для многодорожечной полифонической генерации музыки. Она ориентирована на создание музыкальных последовательностей, где несколько инструментальных…

Подробнее о MuseGAN →
#GAN #polyphonic music #Replicate

Тип проекта: Research

Направление: Audio / Music

Язык: Python / TensorFlow

Разработчик: salu133445 et al.

MusicGen logo

MusicGen

MusicGen — аудио- и музыкальный AI-инструмент, связанный с направлением LLM, инструментал, текст‑в‑музыку. Музыкальная LLM от Meta, генерирует музыкальные композиции по текстовым …

Подробнее о MusicGen →
#LLM #инструментал #текст‑в‑музыку

Тип проекта: Model

Направление: Audio / Music

Язык: Python / PyTorch

Лицензия: MIT (code)

Разработчик: Meta

OpenBioLLM logo

OpenBioLLM

OpenBioLLM — семейство открытых медицинских LLM, созданное Saama AI Labs на базе Llama 3 для biomedical и clinical NLP-задач. Проект ориентирован на исследования и эксперименты с …

Подробнее о OpenBioLLM →
#biomedical #LLM #open-source

Тип проекта: Model

Направление: Biomedical / LLM

Язык: Python / PyTorch

Разработчик: Saama AI Labs

LLaMA 3‑Instruct logo

LLaMA 3‑Instruct

LLaMA 3‑Instruct — универсальный AI-инструмент, связанный с направлением instruction‑tuned, dialogue, open-source. Instruction‑tuned версия LLaMA3 (8B и 70B) с улучшенными навыкам…

Подробнее о LLaMA 3‑Instruct →
#instruction‑tuned #dialogue #open-source

Тип проекта: Model

Направление: LLM

Язык: Python / PyTorch

Лицензия: Llama 3 Community License

Разработчик: Meta AI

Qwen‑Long (QwenLong‑L1‑32B) logo

Qwen‑Long (QwenLong‑L1‑32B)

Qwen‑Long (QwenLong‑L1‑32B) — универсальный AI-инструмент, связанный с направлением long‑context, MoE, document reasoning. Долгоконтекстный MoE‑LLM от Alibaba для reasoning на дли…

Подробнее о Qwen‑Long (QwenLong‑L1‑32B) →
#long‑context #MoE #document reasoning

Тип проекта: Model

Направление: LLM / Long context

Язык: Python / PyTorch

Разработчик: Alibaba Cloud

OpenVoice logo

OpenVoice

OpenVoice — AI-инструмент или платформа в направлении voice cloning, open-source, TTS. Он закрывает озвучку, транскрибацию, синтез речи, обработку аудио или генерацию музыкальных …

Подробнее о OpenVoice →
#voice cloning #open-source #TTS #AI voice

Тип проекта: Model

Направление: Audio / TTS

Язык: Python / PyTorch

Лицензия: MIT

Разработчик: MyShell AI

Bark logo

Bark

Bark — AI-инструмент или платформа в направлении TTS, open-source, AI voice. Он закрывает озвучку, транскрибацию, синтез речи, обработку аудио или генерацию музыкальных материалов…

Подробнее о Bark →
#TTS #open-source #AI voice #audio generation

Тип проекта: Model

Направление: Audio / TTS

Язык: Python / PyTorch

Лицензия: MIT

Разработчик: Suno AI

GPT-SoVITS logo

GPT-SoVITS

GPT-SoVITS — AI-инструмент или платформа в направлении voice cloning, TTS, open-source. Он закрывает озвучку, транскрибацию, синтез речи, обработку аудио или генерацию музыкальных…

Подробнее о GPT-SoVITS →
#voice cloning #TTS #open-source #аудио

Тип проекта: Repository

Направление: Audio / TTS

Язык: Python / PyTorch

Разработчик: Open Source

Demucs logo

Demucs

Demucs — AI-инструмент или платформа в направлении source separation, audio, open-source. Он закрывает озвучку, транскрибацию, синтез речи, обработку аудио или генерацию музыкальн…

Подробнее о Demucs →
#source separation #audio #open-source #music

Тип проекта: Model

Направление: Audio / Music

Язык: Python / PyTorch

Разработчик: Meta AI Research

Segment Anything 2

Segment Anything 2 (SAM 2) — модель Meta для promptable segmentation изображений и видео. Она переносит концепцию Segment Anything на видео, поддерживая интерактивное выделение и …

Подробнее о Segment Anything 2 →
#segmentation #vision #video #Meta

Тип проекта: Model

Направление: Vision / Video

Язык: Python / PyTorch

Лицензия: Apache-2.0

Разработчик: Meta AI / FAIR