音视频多媒体

1.AI短剧素材智能生产系统对接正规短剧版权分销平台,获取已授权的短剧素材库。利用AI工具完成二次剪辑:自动识别每集的高潮片段(如扇巴掌、反转、悬念揭晓),截取2分钟左右的精华切片,生成适合FacebookReels的竖版短视频。支持AI配音翻译与画面优化,适配英语、西语等目标市场语言习惯,让中国式
410Python音视频多媒体
muse ai产品系统Vibe Coding
AI音乐创作商业化产品,覆盖Quick/Master双创作工作台、歌词优化与翻译、风格模板、参考音视频、作品资产库、会员订阅与支付。Agent层负责创作意图澄清、参数补全、任务推荐与生成过程解释。
520HTML5音视频多媒体
DreamStudio是面向短剧与短视频制作的AI创作平台,覆盖以下功能:1.创意与剧本:根据创意生成分集大纲及多集剧本,支持将小说、文学文本改编为剧本。2.分镜拆解:将场景拆解为包含景别、机位和动作描述的分镜表,为后续素材制作提供依据。3.多模型与Agent协作:接入不同模型,结合多Agent协作
760Java人工智能
普音产品系统Vibe Coding
多轨波形编辑:拖拽、剪切、对齐、音量调节、撤销AI音频分析:自动识别BPM、调性、节拍变速变调:RubberBand引擎,变调不变速/变速不变调人声分离:AI一键提取人声/伴奏AI语音指令:自然语言直接指挥剪辑操作一键导出WAV/MP3(多码率)
410Vue音视频多媒体
包含视觉风格库、视频动效库与AISkill合集,支持分类浏览、资源预览及收藏管理,并保留个人添加的内容。安装包内置基础资源,断网时仍可使用;资源内容支持远程增量更新,不必每次重新安装客户端。更新失败可回滚,个人收藏和激活信息不会被覆盖。作品展示的是资产管理软件本身,不主张拥有库中所有第三方素材版权。
500JavaScript开发工具
1.核心逻辑层(core/)watermark_core.py:定义水印参数数据类(WatermarkParams),封装水印位置、大小、旋转角、透明度、颜色等属性;提供核心渲染函数apply_watermark,将水印参数与源图片结合,生成最终输出图像(支持JPEG格式)。font_manager
930Python开发工具
本项目是一款功能完备的多轨音频调音软件,支持WAV与MP3音频导入、0.5x–2.0x变速播放、Loop独立循环及高保真混音导出,同时集成了单轨音量与声像控制、10段图形EQ均衡器、可在波形图上交互绘制的音量自动化包络线以及压缩器。此外,系统还提供60FPS平滑波形图、带削波指示的VU电平表、16m
1330C++音视频多媒体
软件介绍CyberVerse是一个开源的实时数字人Agent框架。我做这个项目时,一直想解决一个很具体的问题:数字人不应该只停留在“生成一段视频”或“播放一个虚拟形象”的阶段。更有意思的是你打开一个界面,选择一个角色,给它配置声音、人设、记忆和模型,然后它真的可以开始和你说话,可以被打断,可以接着聊
2280Python人工智能
MagicMic产品系统
丰富的声音效果:从500多个声音效果中选择,让您听起来像您最喜欢的Vtuber、动漫人物、歌手、演员或名人。热门表情包音效库:访问10万多个热门表情包音效库,为您的对话增添幽默感。实时变声:体验零延迟的语音转换,确保流畅、不间断的游戏或直播体验。AI语音模型:受益于先进的AI技术,该技术提供高质量的
830C++音视频多媒体
写词/管词:用配置好的歌词大模型(如DeepSeek)生成歌词,曲库里维护「仅歌词→生成音乐→去痕/转码」等状态;歌名会与曲库去重、两阶段起名+写词等逻辑。生成音乐:对接Suno/TTAPI等云端或本机流程,排队生成、下载、入库。后期与物料:FFmpeg去痕、转码、整理发布用物料(音频、歌词、封面等
1760Python人工智能
wu-img开源项目
离线图片格式转换客户端,基于Electron构建?️支持拖拽或点击选择图片文件?支持多种格式互转:PNG、JPEG、WebP、AVIF、TIFF、GIF、ICO、ICNS?支持调整输出尺寸?️支持调节JPEG/WebP/AVIF/TIFF输出质量?ICO转换支持自定义多尺寸?批量转换,实时日志?完全
1110HTML5开发工具
项目功能模块包括:1、时间线编辑,各类视频、音频Clip的添加、删除,时间线修改,叠加等;2、各类格式的导出。支持MP4、mov、webp等各类主流音视频格式的导出;3、视频添加各类滤镜效果,mask等。
1180自动化测试音视频多媒体
该项目主要实现基于WebRTC的实时视频预览能力,支持设备端视频流接入、信令交互、音视频流播放以及低延迟显示。系统可结合现有流媒体服务完成实时画面拉取、播放控制和链路联调,重点解决预览时延高、播放不稳定、兼容性差等问题。项目支持结合安防业务场景进行实时查看,并对弱网环境下的连接成功率、首帧速度和播放
1900C++音视频多媒体
-支持将多张图片合成视频:-支持添加单个音烦文件:-支持随机选择音频文件夹中的音频:-支持合成无声视频。-可批量创建视频合成任务,操作简单,可大大提升视频创造的效率。
1040Python开发工具
系统主要功能模块如下:1.视频摄入与规范化:支持本地文件上传或远程URL输入,使用ffmpeg自动提取音频、标准化视频格式2.自动语音识别(ASR):对音频进行语音转文字,生成带时间戳的逐字稿3.智能分段:通过LLM对转录文本进行语义分析,自动切分为30-120秒的知识片段4.AI元数据生成:为每个
1250Java音视频多媒体
项目采用画布节点化设计,核心功能模块包括:1.**智能画布系统**:支持图片上传、拖拽编排、节点连线,提供缩放、平移、多选等丰富交互能力2.**AI图像生成**:集成多种主流AI图像模型(如Midjourney、DALL-E等),支持文本生成图像、图像编辑、风格迁移等能力3.**工具处理链**:内置
2170TypeScript音视频多媒体
1.这是一个基于Tauri2、Vue3与FastAPI的本地音乐播放器桌面应用,主要面向macOS桌面场景。2.项目包含曲库管理、正在播放、设置与日志诊断等功能模块。3.用户可以选择本地音乐目录进行扫描,自动建立曲库索引,按名称、更新时间、时长等方式排序和检索歌曲,并完成播放、暂停、上一首、下一首、
2520Python音视频多媒体
duo-video开源项目
Duo-Video是一个强大的Java视频编辑SDK。通过简洁的json结构组织视频结构,并生成剪映草稿工程文件。支持最新的剪映版本,支持文本模板、花字、多段文本;支持复合片段、特效、支持绿幕...
1810Java音视频多媒体
VDD的设计哲学是:**简单、快速、不打扰。***极简主义设计:没有乱七八糟的广告,没有复杂的弹窗。侧边栏导航,逻辑清晰,打开就能用。*原生性能怪兽:基于Go+Fyne开发,编译为原生二进制文件。内存占用低,启动速度快,不像Electron应用那样吃内存。*订阅自动下载:(v1.4.0重磅功能)支持
1780Go工业互联网
AI翻译字幕开源项目
ai-subtitle-translate是一个基于人工智能的开源字幕识别与翻译工具,专为视频内容创作者、教育工作者与本地化团队设计。它能自动从音视频中识别语音生成字幕,保留时间轴信息并将字幕翻译成多种语言,支持常见字幕格式(如SRT、VTT)和批量处理。项目提供命令行与可扩展的接口,方便集成第三方
1580Python音视频多媒体
当前共26个项目more
×
寻找源码
源码描述
联系方式
提交