音视频多媒体

屏幕录制产品系统
1,需要有操作界面,可以选择录制的原图、录制的画面、录制的声音、录制的文件2,支持录制视频动态,尽量保持跟视频同步3,支持录制声音声音的源头可以是系统播放或者是麦克风4,支持多个分辨率格式保存
130Java音视频多媒体
古代书法字的查询、楷书行书隶书草书篆书的碑帖的整理、书法人物的传记、经典文章的收录。免费面向过所有人,初学者、书法家、历史学者都可以从中受益,传承与弘扬华夏书法艺术。
150C#企业服务
基于Wav2Lip模型开发的音频驱动数字人唇形同步工具,输入单张人物图片与语音音频,即可自动生成口型与音频精准匹配的数字人说话视频,人物眉眼、头部等其余面部区域保持自然静态,适用于短视频制作、数字人播报、课程配音、虚拟解说等场景。1.核心算法:基于GAN生成对抗网络架构,通过提取音频梅尔频谱特征驱动
410Python开发工具
安防摄像头产品系统
1.实时视频监控:多路IPC实时预览、多画面分割、云台控制、变焦、语音对讲。2.录像存储与回放:本地NVR/边缘存储+云端备份,按时间、事件、人脸、车辆检索回放。3.AI智能分析:人形检测、车辆识别、越界报警、区域入侵、徘徊检测、离岗检测、安全帽/反光衣识别、烟火检测。4.报警与联动:入侵报警、门磁
290C++物联网
系统包含四大核心模块:1)内容监听与抓取:支持TikTok等海外平台按关键词或指定账号进行自动扫描监听,实时发现热门视频并批量下载,支持增量更新和去重过滤;2)视频智能去重:基于FFmpeg的多层处理流水线,包含帧率调整、色彩矩阵变换、轻微随机裁剪、音频重采样、HDR转SDR等手段,生成平台无法识别
370Python音视频多媒体
1)剧本结构化:解析场次、人物、动作与状态,形成可机读的场景/镜头骨架。2)分镜资产生成:按镜输出镜头定义、连续性描述与语义状态(不只是一段文案)。3)多渲染器提示词:针对不同图像/视频模型生成可切换的提示词与参数建议,避免一套prompt绑死一家模型。4)批量任务:整本剧本批量出分镜、批量重跑失败
570Python内容平台
全链路实时语音:麦克风WebRTC采集→SileroVAD(含500ms预回填,降低开口丢字)→流式STT→LLM流式生成→流式TTS→WebAudio播放;说话即打断(barge-in),用户插话立即停生成、停发声并重新监听,无需等AI说完。Provider中立:STT/LLM/TTS统一接口,1
460Python人工智能
项目主要包含以下功能模块:1)音乐模块:扫描指定目录入库(支持mp3/flac/wav/ape/ogg/aac/m4a/wma),自动解析ID3元数据(标题、歌手、专辑、时长);支持"默认/喜欢"系统歌单与自定义歌单、播放列表密码锁定;播放栏支持顺序/列表循环/单曲循环/随机四种模式、进度拖动、音量
450Vue音视频多媒体
●远程驾驶:操作员在远程座舱内,通过方向盘、踏板、实体按键等操控矿卡,实现转向、制动、举升等动作,操控体验接近现场驾驶。●超低时延视频回传:1080P环视影像实时回传至座舱屏幕,端到端延迟≤120ms,操作员几乎无感知延迟,保障操控信心。●弱网自适应:矿山网络抖动大、带宽不稳定,系统具备抗弱网能力,
410C++音视频多媒体
软件包含区域截屏、截屏预览、窗口置顶、文字标注、画笔、直线、箭头、矩形、圆形、马赛克、模糊、橡皮擦和颜色拾取等截图功能;录制模块支持电脑屏幕、摄像头、麦克风声音和电脑音频的采集,并提供录制参数设置、视频预览和视频编辑功能。用户可以在同一工作流中完成画面采集、重点标记、录制和结果整理。
360C++开发工具
1.拍摄与上传:提供桌面操作界面,支持相机画面预览、拍摄控制、持续上传及处理进度查看。2.本地视频分析:支持导入已拼接的全景视频或普通视频,开展候选片段提取和高光分析。3.人物检测与场景分区:检测视频中的人物,根据人物位置划分候选场景,从全景画面中提取适合分析的视角。4.多模型高光评审:调用多模态大
531Python音视频多媒体
1.单曲分享链接解析:粘贴链接后展示封面、歌名、歌手和专辑,确认后按账号和歌曲授权选择MP3、WAV或符合资格的FLAC,并逐格式反馈结果与保存位置。2.本地NCM转换:支持文件/文件夹导入、拖放、格式选择、批量队列、实时进度和取消,可输出MP3、FLAC、WAV或保留源格式,并写入可用的标签与封面
650Go音视频多媒体
灵镜是Windows桌面动态壁纸引擎,坚持本地优先、零账户、无广告。三区布局:左侧侧栏、中间壁纸网格、右侧详情抽屉,底部控制条可切播放/音量/循环。支持视频与动图壁纸,拖拽导入本地批量管理;多显示器分三种分配方式。全屏或游戏时自动暂停至0%占用,电池模式自动休眠,按类型分性能档。收藏、主题切换全本地
490Python音视频多媒体
1.AI短剧素材智能生产系统对接正规短剧版权分销平台,获取已授权的短剧素材库。利用AI工具完成二次剪辑:自动识别每集的高潮片段(如扇巴掌、反转、悬念揭晓),截取2分钟左右的精华切片,生成适合FacebookReels的竖版短视频。支持AI配音翻译与画面优化,适配英语、西语等目标市场语言习惯,让中国式
460Python音视频多媒体
1.多平台采集:每平台支持关键词搜索、指定视频、创作者主页三种抓取模式,支持二级评论与回复下钻。2.登录态管理:二维码扫码、手机号验证码、Cookie导入、CDP远程浏览器四种登录方式,自动持久化到本地。3.可视化配置控制台(v7):浏览器访问http://127.0.0.1:5556/v7,分组卡
1000Python音视频多媒体
在核心功能上,系统能加载MP3、WAV等多种常见格式的伴奏与人声音频文件,同时通过优化的音频采集模块实时获取麦克风输入信号,实现三路音频流的独立播放控制、音量精准调节(0-100%步进)及实时混合输出,混合过程无卡顿、无杂音,保障音频协同效果。界面设计上,系统通过QML构建直观的可视化操作界面,不仅
560C++音视频多媒体
维活体检测 双目摄像头+红外+动作指令,有效防止照片、视频、3D面具、蜡像等攻击人证合一核验 公安部SAM模块读取身份证,现场人像与证件照片1:1比对,满足实名制合规智能防尾随 红外光栅阵列+AI行为分析,识别紧贴、抱小孩、钻爬等异常通行并告警闯入联动抓拍 非法闯入瞬间触发声光报警,并联动摄像头抓拍
680C++工业互联网
画布网站产品系统
本项目为自研无线(无限)画布可视化网站,主打无边界自由交互体验,完整实现画布核心商用功能。支持画布无级缩放、平滑平移、鼠标滚轮精准控制,适配电脑端全尺寸展示;支持自定义节点拖拽、添加、删除、连线关联,可自由排布工作流、思维导图、创作节点;内置元素层级管理、画布视口自适应、操作防抖、拖拽吸附、边界限位
510HTML5内容平台
innosales产品系统
爬虫!AI文案生成以及海报生成AI进行短视频的生成支付系统注册系统面板系统等等日志模块安全防御模块数据库的字段的设计爬虫模块ai系统的设计提示词设计照片、视频、文案生成功能的设计
560Python医疗健康
一套视频隐私保护系统,由video-nw桌面客户端和video在线平台组成。客户端支持人脸、车牌自动识别与打码,提供视频预览、结果导出和处理记录,帮助用户高效完成敏感信息遮挡。在线平台提供账号登录、套餐管理、卡密兑换和使用额度管理,覆盖从购买、授权到视频处理的完整流程,适用于视频发布前的隐私保护。
920Python音视频多媒体
当前共173个项目more
×
寻找源码
源码描述
联系方式
提交