如烟导航
  • 首页
  • QQ群
      • 未登录
        登录后即可体验更多功能
      未登录
      登录后即可体验更多功能

      AI开源项目

      共 97 篇网址
      排序
      发布更新浏览点赞
      Fluid

      Fluid

      一个创新的文本到图像生成模型,通过使用连续标记和随机生成顺序,显著提高了图像生成的质量和性能
      3850
      AI开源项目# AI开源项目
      Motionshop

      Motionshop

      一个强大的工具,能够快速将视频中的人物替换为3D虚拟形象,同时保持视频的自然感和连贯性
      3840
      AI开源项目# AI开源项目
      Follow Your Pose

      Follow Your Pose

      一个创新的文本到视频生成框架,它通过两阶段训练策略实现了高度的姿态控制和时间连贯性。该框架不仅能够根据文本描述生成视频,还能让用户通过姿态序列精确控制视频中角色的动作...
      3830
      AI开源项目# AI开源项目
      MMMLU

      MMMLU

      重要的多语言、多任务语言理解数据集,它为研究人员和开发者提供了一个标准化的测试基准,用于评估和提升AI模型在不同语言和文化背景下的性能。
      3810
      AI开源项目# AI开源项目# AI模型评估# 国际化业务
      onewebot2

      onewebot2

      易于使用的微信AI机器人软件包,它通过简化的配置流程和一键运行功能,使得用户能够快速启动和运行微信机器人。无论是个人还是企业,都能通过oneWebot2创建智能助手,实现自动化服务
      3800
      AI开源项目# AI开源项目# API集成# 一键运行
      DreaMoving

      DreaMoving

      一个强大的视频生成框架,通过其创新的Video ControlNet和Content Guider,实现了对视频内容的高度控制
      3790
      AI开源项目# AI开源项目
      Roop

      Roop

      一个功能强大的换脸工具,以其简单易用和高性能的特点,为用户提供了一种便捷的方式来实现视频中的面孔替换
      3780
      AI开源项目# AI开源项目
      Tailor

      Tailor

      一款集视频剪辑、生成和优化功能于一身的智能视频处理工具,凭借其简单易用的操作方式、强大的功能和智能高效的处理能力
      3720
      AI开源项目# AI开源项目
      Ovis1.6

      Ovis1.6

      强大的多模态大模型,它通过创新的架构设计和全面的数据优化,在多模态任务上展现了卓越的性能。
      3670
      AI开源项目# AI开源项目
      ScreenAgent

      ScreenAgent

      一个先进的计算机控制智能体,它通过观察屏幕截图和执行鼠标键盘动作来完成复杂的任务。它利用VLM和强化学习环境,可以在真实计算机屏幕上执行多步骤任务。
      3650
      AI开源项目# AI开源项目# ScreenAgent# VLM
      GameNGen

      GameNGen

      由谷歌推出的世界首个完全由AI驱动的游戏引擎,旨在颠覆传统的游戏开发方式。这个引擎利用神经网络实时生成游戏画面,无需手动编写代码
      3650
      AI开源项目# AI开源项目
      MIMO

      MIMO

      创新的AI框架,它通过空间分解建模技术,提供了一种先进的可控角色视频合成方法。
      3640
      AI开源项目# 3D感知合成# AI开源项目# AI框架
      Unique3D

      Unique3D

      个创新的单图像 3D 网格生成工具,以其高保真度、高效训练和优化以及强泛化能力脱颖而出
      3640
      AI开源项目# AI开源项目
      Clapper

      Clapper

      一个创新的AI视频创作工具,它通过提供一个交互式和直观的创作平台,降低了视频制作的门槛
      3640
      AI开源项目# AI开源项目
      DeepTranslate

      DeepTranslate

      一款功能强大、使用便捷的免费AI双语页面翻译浏览器插件。它支持多种语言和翻译API,能够满足用户在不同场景下的翻译需求
      3640
      AI开源项目# AI开源项目# AI浏览器插件
      STranslate

      STranslate

      一款实用的翻译和OCR工具,以其即用即走的特点、开源免费的优势以及社区支持的便利性,为用户提供了高效、便捷的文本处理解决方案
      3630
      AI开源项目# AI开源项目
      V-JEPA

      V-JEPA

      创新的自监督学习模型,它通过预测视频帧的特征表示来学习视频的视觉表示。这种方法不仅能够处理视频内容,还能在图像任务上表现出色,具有广泛的应用潜力。
      3620
      AI开源项目# AI开源项目# Transformer模型# 多模态学习
      CosyVoice2.0

      CosyVoice2.0

      先进的语音合成模型,通过其低延迟、高准确性和强稳定性的特点,为用户提供高质量的语音合成体验
      3590
      AI开源项目# AI开源项目
      JoyHallo

      JoyHallo

      一个功能强大的数字人模型,专注于普通话和英语的音频驱动视频生成。它通过优化模型结构和数据集支持,实现了高效的跨语言生成能力,并在推理速度和准确性上表现出色
      3560
      AI开源项目# AI开源项目
      RMBG-2.0

      RMBG-2.0

      由BRIA AI推出的一款下一代图像背景移除模型,它基于创新的BiRefNet架构,能够在复杂环境中提供高精度的背景移除结果
      3550
      AI开源项目# AI开源项目
      Real-ESRGAN

      Real-ESRGAN

      一个强大的图像超分辨率工具,它利用深度学习和生成对抗网络,在没有真实高分辨率图像作为参考的情况下,通过合成退化过程来提升低分辨率图像的质量。
      3540
      AI开源项目# AI开源项目# GAN技术# U-Net判别器
      MinerU

      MinerU

      一个功能强大的PDF内容提取工具,通过其多模态内容处理、结构和格式保留、公式识别与转换、干扰元素去除、乱码识别与处理以及高质量解析工具链等主要功能,能够高效地从PDF文档中...
      3540
      AI开源项目# AI开源项目
      FunAudioLLM

      FunAudioLLM

      由阿里巴巴集团通义语音团队开发的框架,旨在增强人类与大型语言模型(LLMs)之间的自然语音交互
      3510
      AI开源项目# AI开源项目
      ConsiStory

      ConsiStory

      它提供了一种快速、高效且训练无关的方法来生成一致性图像,特别适用于需要保持主题一致性的应用场景。它不仅能够处理单主题场景,还能够应对多主题挑战,并与现有的图像编辑工具...
      3500
      AI开源项目# AI开源项目
      SUPIR

      SUPIR

      一款功能强大且多用途的图像恢复工具,它通过结合AI技术和文本驱动的智能恢复,能够为用户提供高保真度的图像恢复服务
      3500
      AI开源项目# AI开源项目
      HivisionIDPhotos

      HivisionIDPhotos

      HivisionIDPhotos是一个功能全面、操作简便的AI证件照制作工具。它不仅能够满足用户对证件照的基本制作需求,还提供了人像抠图、底色添加、排版照生成等高级功能
      3500
      AI开源项目# AI开源项目
      eSearch

      eSearch

      一款综合性的屏幕识别和搜索工具,它通过集成多种实用功能,为用户提供了一个便捷的工作流程,从截图到文本识别,再到信息搜索和翻译,eSearch都能够提供高效的解决方案
      3470
      AI开源项目# AI开源项目
      SafeEar

      SafeEar

      创新的音频伪造检测工具,它通过先进的AI技术保护用户的语音隐私,同时提供高效的伪造音频检测能力。
      3460
      AI开源项目# AI开源项目# AI框架# 多语言支持
      Swarm

      Swarm

      Swarm是一个由OpenAI解决方案团队管理的教育框架,旨在探索轻量级、易于使用的多智能体编排技术。
      3390
      AI开源项目# AI开源项目
      书生·物华2.0(3DTopia 2.0)

      书生·物华2.0(3DTopia 2.0)

      采用创新的原语(primitive-based)三维表示方法PrimX,能够高效编码和生成具有物理基础渲染(PBR)特性的高质量三维资产。
      3340
      AI开源项目# AI开源项目
      加载更多
      Copyright © 2026 如烟导航 

       豫ICP备2024076496号

       
      ×
      收藏本站!
      希望您能通过知乎、公众号、简书、豆瓣、抖音、微博、微信、个人网站等媒介告诉身边朋友进站必读

      • 如烟笔记如烟笔记
      • 花瓣花瓣
      • 可画设计可画设计
      • 喜马拉雅喜马拉雅
      • 小红书小红书
      • 抖音抖音

      • 添加应用添加应用
      • 关闭折叠dock栏
      • 网站提交网站提交
      ×

      添加应用

      添加后右键点击即可删除







      确定删除该应用吗?

      反馈
      让我们一起共建文明社区!您的反馈至关重要!
      网址
      网址文章软件书籍