音视频多媒体

项目定位:用户一句话描述主题,AI自动从长视频中裁剪跑题/废话/停顿段落,输出主题相关短视频片段。全程本地处理,不上传云端。GitHub开源MIT,中英文README+PRD文档。1、功能模块:6步管线——Step1意图提取(NL→视频路径+主题+强度)、Step2Whisper转字幕、Step2.
580Python人工智能
onnx-wakeword开源项目
1、项目有哪些具体功能模块跨平台推理适配模块、五层防误唤醒检测模块、模型加载解析模块、音频梅尔频谱转换模块、多唤醒词并行识别模块。2、项目的主要功能描述支持加载各类框架导出的ONNX唤醒词模型,内置五层独立可控防误触发检测逻辑,搭配倍率、阈值、置信度可视化调节;一套代码兼容ESP32、Android
720Python人工智能
本项目为AI语音转换系统,基于Python+PyTorch开发,支持本地离线部署运行。主要功能包括:支持音色迁移、语音转换,可将输入音频转换为指定目标音色。支持本地模型加载与推理,保障数据隐私,不上传云端。可在Windows/Linux环境运行,转换效率高。可用于内容创作、语音演示、音频处理等场景,
860Python人工智能
当前共3个项目more
×
寻找源码
源码描述
联系方式
提交