AI开源项目

共 97 篇网址

MagicVideo-V2

一个创新的AI视频生成框架，它通过集成多个模块来生成高质量的视频内容。它不仅提高了视频生成的效率和质量，还确保了视频画面的流畅和逼真，为用户提供了极佳的观看体验。

2420

AI开源项目 # AI开源项目 # AI视频生成 # 多阶段生成

CosyVoice2.0

先进的语音合成模型，通过其低延迟、高准确性和强稳定性的特点，为用户提供高质量的语音合成体验

2400

AI开源项目 # AI开源项目

DeepTranslate

一款功能强大、使用便捷的免费AI双语页面翻译浏览器插件。它支持多种语言和翻译API，能够满足用户在不同场景下的翻译需求

2400

AI开源项目 # AI开源项目 # AI浏览器插件

Gummy

创新的语音翻译大模型，它通过端到端的设计和深度学习技术，实现了高质量的实时语音翻译。无论是在国际会议、教育培训、旅游导航还是客户服务和医疗咨询等场景中，Gummy都能提供高...

2380

AI开源项目 # AI开源项目

abab-music-1

一个强大的AI音乐生成工具，它通过先进的技术，使得音乐创作更加便捷和高效。无论是专业的音乐制作人还是业余爱好者，都能够利用这个模型来创作出高质量的音乐作品。

2370

AI开源项目 # AI开源项目 # AI音乐生成 # 业余音乐制作

EMO

EMO通过其先进的音频驱动视频生成技术，为用户带来了一种创新的方式来创造个性化和富有表现力的视频内容。它不仅能够生成逼真的面部表情，还能根据音频内容自然地驱动头部动作，为...

2370

AI开源项目 # AI开源项目 # AI视频生成 # 动态帧过渡

Unique3D

个创新的单图像 3D 网格生成工具，以其高保真度、高效训练和优化以及强泛化能力脱颖而出

2370

AI开源项目 # AI开源项目

RMBG-2.0

由BRIA AI推出的一款下一代图像背景移除模型，它基于创新的BiRefNet架构，能够在复杂环境中提供高精度的背景移除结果

2370

AI开源项目 # AI开源项目

Seaweed APT

一个具有突破性的AI工具，通过单步生成技术大幅提升了视频和图像生成的效率，同时保持了高质量的生成效果

2370

AI开源项目 # AI开源项目

STranslate

一款实用的翻译和OCR工具，以其即用即走的特点、开源免费的优势以及社区支持的便利性，为用户提供了高效、便捷的文本处理解决方案

2350

AI开源项目 # AI开源项目

Ovis1.6

强大的多模态大模型，它通过创新的架构设计和全面的数据优化，在多模态任务上展现了卓越的性能。

2340

AI开源项目 # AI开源项目

MMMLU

重要的多语言、多任务语言理解数据集，它为研究人员和开发者提供了一个标准化的测试基准，用于评估和提升AI模型在不同语言和文化背景下的性能。

2330

AI开源项目 # AI开源项目 # AI模型评估 # 国际化业务

Roop

一个功能强大的换脸工具，以其简单易用和高性能的特点，为用户提供了一种便捷的方式来实现视频中的面孔替换

2330

AI开源项目 # AI开源项目

FunAudioLLM

由阿里巴巴集团通义语音团队开发的框架，旨在增强人类与大型语言模型（LLMs）之间的自然语音交互

2330

AI开源项目 # AI开源项目

Motionshop

一个强大的工具，能够快速将视频中的人物替换为3D虚拟形象，同时保持视频的自然感和连贯性

2310

AI开源项目 # AI开源项目

Clapper

一个创新的AI视频创作工具，它通过提供一个交互式和直观的创作平台，降低了视频制作的门槛

2300

AI开源项目 # AI开源项目

Tailor

一款集视频剪辑、生成和优化功能于一身的智能视频处理工具，凭借其简单易用的操作方式、强大的功能和智能高效的处理能力

2290

AI开源项目 # AI开源项目

OmniGen

创新的统一图像生成模型，它通过简化架构和整合多种图像生成任务，为用户提供了一个强大而灵活的工具。它不仅能够处理文本到图像的生成，还能够执行图像编辑、主题驱动生成和视觉...

2280

AI开源项目 # AI开源项目 # 多任务图像处理框架 # 多模态输入支持

eSearch

一款综合性的屏幕识别和搜索工具，它通过集成多种实用功能，为用户提供了一个便捷的工作流程，从截图到文本识别，再到信息搜索和翻译，eSearch都能够提供高效的解决方案

2280

AI开源项目 # AI开源项目

ScreenAgent

一个先进的计算机控制智能体，它通过观察屏幕截图和执行鼠标键盘动作来完成复杂的任务。它利用VLM和强化学习环境，可以在真实计算机屏幕上执行多步骤任务。

2250

AI开源项目 # AI开源项目 # ScreenAgent # VLM

MinerU

一个功能强大的PDF内容提取工具，通过其多模态内容处理、结构和格式保留、公式识别与转换、干扰元素去除、乱码识别与处理以及高质量解析工具链等主要功能，能够高效地从PDF文档中...

2240

AI开源项目 # AI开源项目

Llama 3.2

在图像理解和文本处理任务上展现出卓越的性能，并通过定制化微调和本地部署，推动了AI技术的开放性和可访问性。

2230

AI开源项目 # AI大模型 # AI开源项目 # 图像理解

JoyHallo

一个功能强大的数字人模型，专注于普通话和英语的音频驱动视频生成。它通过优化模型结构和数据集支持，实现了高效的跨语言生成能力，并在推理速度和准确性上表现出色

2230

AI开源项目 # AI开源项目

HivisionIDPhotos

HivisionIDPhotos是一个功能全面、操作简便的AI证件照制作工具。它不仅能够满足用户对证件照的基本制作需求，还提供了人像抠图、底色添加、排版照生成等高级功能

2220

AI开源项目 # AI开源项目

OmniParser

一个创新的屏幕解析工具，它通过与先进的视觉语言模型结合，显著提升了智能代理在用户界面中的操作能力

2220

AI开源项目 # AI开源项目

FaceChain

它通过结合Stable Diffusion模型和LoRA风格化模型，为用户提供了一个简单易用的平台来生成个性化的数字形象和写真。无论是用于个人娱乐还是专业需求，FaceChain都能满足用户的多样...

2190

AI开源项目 # AI图像生成 # AI开源项目 # 个性化定制

书生·物华2.0（3DTopia 2.0）

采用创新的原语（primitive-based）三维表示方法PrimX，能够高效编码和生成具有物理基础渲染（PBR）特性的高质量三维资产。

2190

AI开源项目 # AI开源项目

ActAnywhere

一个强大的视频生成工具，它通过自动化的前景与背景融合技术，极大地简化了视频背景生成的过程。它的应用场景广泛，从电影制作到教育，都能提供高效、创新的解决方案。

2180

AI开源项目 # AI开源项目 # 交互式视频编辑 # 人工智能

Seed-VC

一个创新的声音转换工具，它通过零样本学习技术，能够在不需要特定目标音色样本的情况下实现高质量的声音转换

2180

AI开源项目 # AI开源项目

EasyAnimate

基于Transformer架构的视频生成工具，提供了高效、灵活的视频生成解决方案

2150

AI开源项目 # AI开源项目

×

收藏本站！

希望您能通过知乎、公众号、简书、豆瓣、抖音、微博、微信、个人网站等媒介告诉身边朋友进站必读