音视频多媒体

提供主播素材管理、任务队列、参考视频分析、风格配方、脚本与导演规划、Agnes视频生成、IndexTTS分段配音、HeyGem或Duix口型同步、候选质检、最终复核、包装与多平台发布计划。只读看板从真实运行目录汇总任务和产物,发布步骤必须显式批准。
80Python人工智能
提供素材新增、修改、删除和列表查询接口;MySQL数据同步至Qdrant;支持全量索引重建;按文案执行向量检索并结合多标签过滤;提供健康检查、OpenAPI文档和DockerCompose一键启动。冒烟测试覆盖CRUD、中文检索、标签筛选、同步与删除完整闭环。
70Python人工智能
浏览器扩展识别页面媒体和下载意图,通过NativeMessaging连接本地服务;支持普通文件、流媒体及多种下载引擎调度,提供新增任务、暂停与继续、重试、批量控制、搜索分页、收藏、状态和进度展示、引擎健康检查、已下载文件索引及本地视频预览。
230Python音视频多媒体
系统支持B站、抖音和小红书等内容平台,可通过关键词搜索或粘贴分享链接导入案例,并批量获取标题、封面、作者及互动数据。系统利用语音识别和大模型分析视频内容,自动提取选题、目标人群、开场钩子、内容结构、情绪节奏、行动引导、分镜和字幕等16项爆款模板字段,支持卡片查看、横向对比及CSV导出。在此基础上还可
620Python人工智能
本项目是一个基于Web的实时3D音频可视化工具,核心功能包括:1.实时音频分析:通过WebAudioAPI的AnalyserNode,以60fps的帧率实时解析音频源(用户上传文件、麦克风输入或内置示例曲目)的频域和时域数据,输出512个频段的精细能量值。2.3D粒子场渲染:采用Three.js构建
190HTML5音视频多媒体
本项目是一个基于Web的实时3D音频可视化工具,核心功能包括:1.实时音频分析:通过WebAudioAPI的AnalyserNode,以60fps的帧率实时解析音频源(用户上传文件、麦克风输入或内置示例曲目)的频域和时域数据,输出512个频段的精细能量值。2.3D粒子场渲染:采用Three.js构建
240PHP音视频多媒体
后端使用Python集成了对主流视频平台后端去水印解析代码,解析后返回到前端的是无水印的下载地址。同时支持部分AI生图平台进行解析去水印功能,简单易用。
130小程序音视频多媒体
项目包含完整的老照片修复产品流程:首页展示产品卖点、修复前后对比案例、AI修复能力、三步使用流程、价格积分包、FAQ等内容。用户可以进入登录页,通过邮箱魔法链接或演示模式进入工作台;工作台支持上传JPG、PNG、WebP图片,校验文件格式和大小,展示原图预览,创建修复任务,消耗积分,并展示修复后的b
270CSS人工智能
系统支持用户注册登录、创建和加入观影房间、房主与成员权限管理、当前媒体切换、房间状态实时同步、成员状态更新、聊天互动及房间设置。平台可以解析B站BV号、完整链接、短链和分P链接,也可以识别抖音公开分享链接并在房间内加载媒体;对于暂不支持站内播放的网盘链接,会提供明确提示。系统同时包含响应式页面、房间
270postgres音视频多媒体
1.系列剧本管理:多集剧本+角色库+场景库,支持集数导航与版本切换;2.剧本编辑器:分镜、对白、旁白、镜头提示词一站式编辑,支持协作批注;3.多平台AI视频生成:无缝对接国内主流视频生成API(可灵/即梦/混元/Vidu/Seedance等),同一剧本可生成多风格视频素材;4.画布流编排:拖拽式视频
340Python人工智能
1.内容Feed流:图文/视频/段子多类型内容聚合,详情页完整;2.任务中心:阅读/分享/邀请等多任务体系,奖励即时到账;3.邀请裂变:专属邀请码+下线奖励机制,自动统计佣金;4.提现系统:余额管理+多渠道提现申请(微信/支付宝);5.多端编译:同一套代码同时发布至微信/抖音/支付宝三端。
240HTML5内容平台
本项目是一个面向本地小店的短视频内容生成工具。用户填写店铺类型、主推产品、目标顾客、优惠卖点和发布平台后,系统可以生成店铺定位诊断、10条短视频选题、3条可拍摄脚本、拍摄清单、发布文案和销售话术。项目还支持本地任务历史记录,方便回看、搜索、归档已有生成结果,并提供FFmpeg竖屏视频预览和Whisp
371SQLite内容平台
轻量化本地版本管理工具,机制类似简化版Git,基于本地存储,针对小型脚本、单机程序实现项目历史版本追溯;支持版本快速回滚,新版本出现Bug、程序崩溃时,可切换历史版本进行代码比对、调试与二次开发;采用压缩包形式持久化存储项目快照,配套可视化界面,直观展示版本列表、修改记录。
340Python脚本插件
画布支持以下节点:-文本节点:脚本、品牌文案、广告词-图片节点:海报、角色、分镜、参考图-视频节点:动画、广告和短视频-音频节点:文字转语音、配音和音乐,目前标记为Beta-分镜节点:根据故事文本生成镜头脚本-导演台:批量编排下游节点及提示词-电商节点:批量生成不同平台尺寸-图片集节点:聚合电商处理
450Java人工智能
本项目是一个包含Web端和微信小程序的完整AIGC视频创作闭环产品,主要包含以下核心功能模块:AI创作核心模块:支持多模态AI视频生成、爆款短视频一键复刻、数字人对口型换脸、TTS语音克隆等全链路创作功能。智能体工作流模块:内置基于Coze平台的专属智能体,支持定制化的AI视频分析与生成工作流。商业
480Python音视频多媒体
1.多源文本清洗与标准化模块:针对多源书籍数据格式不一的问题,建立文本清洗与格式化规则引擎。自动剔除冗余字符、规范段落排版,并结合多源书籍比对功能进行交叉验证,从源头大幅提升输入数据的准确率与规范性。2.AI辅助校对与质检模块:创新性引入ASR(自动语音识别)技术辅助校对,通过“文本-TTS-ASR
490Python音视频多媒体
#DoitSynth功能模块详解基于Tauri2+React+webaudio的多平台合成器,内置8声道合成器与鼓引擎,24个可编程打击垫(4×6)及步进音序器。##1.打击垫系统24个彩色编码打击垫,8色对应8合成器槽位。支持单音/和弦触发,每垫独立音量、持续时间、防误触间隔,触发弹跳动画。##2
370Android开发工具
本项目是一款功能完备的多轨音频调音软件,支持WAV与MP3音频导入、0.5x–2.0x变速播放、Loop独立循环及高保真混音导出,同时集成了单轨音量与声像控制、10段图形EQ均衡器、可在波形图上交互绘制的音量自动化包络线以及压缩器。此外,系统还提供60FPS平滑波形图、带削波指示的VU电平表、16m
520C++音视频多媒体
前端:1、图片生成模块:拍摄,展示2、图片收藏模块:查看,修改,删除3、微信登录后端:1、图片AI生成模块2、图片收藏模块3、登录、鉴权运维:腾讯云,对象存储桶等
370Java音视频多媒体
1.图片上传模块支持用户从本地选择并上传需要处理的图片。主要功能包括:图片文件选择;图片格式校验;文件大小校验;图片加载状态提示;上传失败提示;图片重新选择和替换。2.水印区域框选模块用户上传图片后,可以在图片预览区域中框选需要去除的水印、文字或其他目标内容。该模块支持:鼠标拖动框选;移动端触摸框选
330Java音视频多媒体
当前共74个项目more
×
寻找源码
源码描述
联系方式
提交