#AI开源项目 - 导航集 - 索猎 - 聚合未来 - 一站式多元化综合门户 - suoLieStart

在【导航集】圈子中标签「AI开源项目」。圈子简介:一切皆导航,网址导航。资源导航,生活工作娱乐导航,你推荐在这里会被他人添加到桌面。 付费快收联系QQ:452999083

🌐 圈子广场📌 导航集🔖 #AI开源项目
← 返回圈子✕ 清除筛选

🔖【标签#AI开源项目】相关帖子

共 68 条

Ollama

「Ollama」是什么Ollama是一款助力用户在本地轻松运行大语言模型的工具。它能让你在自己的设备上运行诸如Llama 3.3、DeepSeek-R1、Phi-4、Mistral、Gemma 2等多种模型。并且,无论是macOS、Linux还是Windows系统,它都能完美适配,为用户带来便捷的本...

Ollama

Upscayl

「Upscayl」是什么Upscayl是一款借助AI技术提升图像质量的工具。它免费且开源,操作简单,能将模糊不清的图像转变为清晰的艺术之作,适合创作者、企业、设计师等各类人群使用。功能解析图像无损放大:可将图像分辨率提升高达16倍,有效改善图像的清晰度与细节,且不会对图像质量造成损失。色彩精准保留:...

Upscayl

驭码CodeRider

「驭码CodeRider」是什么驭码CodeRider是一款致力于构建企业专属AI DevOps平台的产品,通过AI赋能软件研发,为程序员提供高效的编程辅助支持。它有着诸多实用功能和特色,能满足不同研发需求。功能解析代码处理:具备代码补全、解释、注释、修改和优化功能,为开发者提供便利。代码补全可智能...

驭码CodeRider

Seaweed APT

Seaweed-APT是什么:Seaweed-APT是一个基于扩散模型(Diffusion Model)和对抗后训练(Adversarial Post-Training)技术的AI工具,专注于实现单步(One-Step)视频和图像生成。它能够在极短的时间内生成高质量的视频和图像内容,显著提高了生成效...

Seaweed APT

Motionshop

Motionshop是什么:Motionshop是一个用于将视频中的人物角色替换为3D虚拟形象的框架。它通过视频处理、姿态估计和渲染等技术,将真实人物替换为3D虚拟角色,同时保持视频的自然感和连贯性。 主要特点:...

Motionshop

Mochi 1

Mochi 1是什么:Mochi 1是Genmo发布的一个开源的、高保真度的视频生成模型,能够生成高质量的动态视频,并且严格遵循文本提示。Genmo的目标是通过其技术解锁人工智能的“右脑”,即创意和想象力。<hr>主要特点:<ol start="1">高质量视频生成:Mochi...

Mochi 1

Swarm

<h2 class>Swarm简介Swarm是一个由OpenAI解决方案团队管理的教育框架,旨在探索轻量级、易于使用的多智能体编排技术。它目前是一个实验性的样本框架,主要用于探索多智能体系统的用户友好接口,并非用于生产环境,因此没有官方支持。<h2...

Swarm

JoyHallo

JoyHallo是什么:JoyHallo是一个面向普通话(Mandarin)的数字人模型,由JD Health International Inc.开发。它专注于通过音频驱动视频生成,能够生成高质量的普通话和英语视频内容。该模型通过结合先进的音频特征嵌入技术和半解耦结构,实现了高效的跨语言视频生成能...

JoyHallo

Fluid

Fluid是什么:Fluid是一个用于文本到图像生成的自回归模型,专注于通过连续标记(tokens)扩展模型规模,以提高生成图像的质量和性能。该模型由Google DeepMind和MIT的研究人员共同开发,旨在解决视觉领域中自回归模型扩展不如大型语言模型有效的难题。主要特点:连续标记的使用:与传统...

Fluid

OpenVoice

OpenVoice是什么:OpenVoice是一个由麻省理工学院(MIT)和MyShell合作开发的即时语音克隆工具,它是一个音频基础模型,能够实现高精度的语音克隆和灵活的语音风格控制。主要特点:精确的音色克隆:OpenVoice能够准确地克隆参考音色,并生成多种语言和口音的语音。灵活的语音风格控制...

OpenVoice

AtomoVideo

AtomoVideo是什么:AtomoVideo是一个高保真图像到视频(Image-to-Video, I2V)生成框架,能够从输入图像生成高保真视频。它在运动强度和一致性方面优于现有技术,并且可以兼容各种个性化的文本到图像(T2I)模型,无需特定调整。主要特点:高保真视频生成:AtomoVideo...

AtomoVideo

CosyVoice2.0

CosyVoice2.0是什么:CosyVoice 2.0是一个由阿里巴巴集团通义语音团队开发的高性能流式语音合成模型。它基于Transformer架构,通过一系列优化,实现了低延迟、高准确性和强稳定性的语音合成。CosyVoice...

CosyVoice2.0

EchoMimic

EchoMimic是什么EchoMimic是一个用于生成逼真音频驱动肖像动画的工具,它能够通过音频和面部地标单独或两者结合来生成肖像视频。主要特点多驱动方式:EchoMimic可以单独使用音频或面部地标来驱动图像生成视频,也可以将两者结合使用,提供了更灵活的驱动方式。训练策略创新:采用了一种新颖的训...

EchoMimic

DreaMoving

DreaMoving是什么:DreaMoving是一个基于扩散模型的可控视频生成框架,旨在生成高质量的定制化人类视频。具体来说,给定目标身份和姿势序列,DreaMoving可以生成目标身份在任何地方跳舞的视频,由姿势序列驱动。为此,DreaMoving提出了一个Video...

DreaMoving

Clapper

Clapper是什么:Clapper是一个开源的AI故事可视化工具,旨在通过交互式、迭代和直观的过程,让任何人能够使用AI创建视频,无需外部工具、电影制作或AI工程技能。它不是为了取代传统的视频编辑器或现代使用3D场景作为输入的AI编辑器,而是提供了一种全新的视频创作方式。用户在Clapper中不是...

Clapper

FunAudioLLM

FunAudioLLM是什么:FunAudioLLM是一个由阿里巴巴集团通义语音团队开发的框架,旨在增强人类与大型语言模型(LLMs)之间的自然语音交互。该框架包含两个创新模型:SenseVoice和CosyVoice。SenseVoice用于高精度的多语言语音识别、情感识别和音频事件检测;Cosy...

FunAudioLLM

GPT-SoVITS

GPT-SoVITS是什么GPT-SoVITS是一个开源的声音克隆项目,由RVC-Boss在GitHub上发布。它允许用户使用极少的数据(如1分钟的语音数据)来训练一个高质量的文本到语音(TTS)模型,实现声音克隆。这个项目特别适合需要快速生成特定声音模型的用户,如内容创作者、语音合成开发者等。主要...

GPT-SoVITS

NotebookLlama

NotebookLlama是什么:NotebookLlama是Meta推出的一个开源项目,旨在将PDF文档自动转换成播客内容。该项目利用LLaMa模型进行PDF预处理、生成播客脚本、增加戏剧化元素以及文本转语音合成,整个过程无需人工干预,能够产出专业水准的播客内容。NotebookLlama为用户提...

NotebookLlama
广告 · 推广内容
热门/赞助位
立即入驻
公益宣传
公益宣传