音视频多媒体

浏览器扩展识别页面媒体和下载意图,通过NativeMessaging连接本地服务;支持普通文件、流媒体及多种下载引擎调度,提供新增任务、暂停与继续、重试、批量控制、搜索分页、收藏、状态和进度展示、引擎健康检查、已下载文件索引及本地视频预览。
40Python音视频多媒体
本项目是一个基于Web的实时3D音频可视化工具,核心功能包括:1.实时音频分析:通过WebAudioAPI的AnalyserNode,以60fps的帧率实时解析音频源(用户上传文件、麦克风输入或内置示例曲目)的频域和时域数据,输出512个频段的精细能量值。2.3D粒子场渲染:采用Three.js构建
140HTML5音视频多媒体
系统支持用户注册登录、创建和加入观影房间、房主与成员权限管理、当前媒体切换、房间状态实时同步、成员状态更新、聊天互动及房间设置。平台可以解析B站BV号、完整链接、短链和分P链接,也可以识别抖音公开分享链接并在房间内加载媒体;对于暂不支持站内播放的网盘链接,会提供明确提示。系统同时包含响应式页面、房间
230postgres音视频多媒体
轻量化本地版本管理工具,机制类似简化版Git,基于本地存储,针对小型脚本、单机程序实现项目历史版本追溯;支持版本快速回滚,新版本出现Bug、程序崩溃时,可切换历史版本进行代码比对、调试与二次开发;采用压缩包形式持久化存储项目快照,配套可视化界面,直观展示版本列表、修改记录。
320Python脚本插件
#DoitSynth功能模块详解基于Tauri2+React+webaudio的多平台合成器,内置8声道合成器与鼓引擎,24个可编程打击垫(4×6)及步进音序器。##1.打击垫系统24个彩色编码打击垫,8色对应8合成器槽位。支持单音/和弦触发,每垫独立音量、持续时间、防误触间隔,触发弹跳动画。##2
370Android开发工具
本项目是一款功能完备的多轨音频调音软件,支持WAV与MP3音频导入、0.5x–2.0x变速播放、Loop独立循环及高保真混音导出,同时集成了单轨音量与声像控制、10段图形EQ均衡器、可在波形图上交互绘制的音量自动化包络线以及压缩器。此外,系统还提供60FPS平滑波形图、带削波指示的VU电平表、16m
520C++音视频多媒体
VoiceCloneTTS是一款面向个人创作者和办公用户的本地化文字转语音桌面软件,提供五种核心能力:1)粘贴朗读模式:把任意文本复制到剪贴板后,软件自动识别并朗读,可调节语速/音调/音量,播放即所得;2)截屏OCR模式:框选屏幕任意区域,自动识别中英文并朗读,解决"图片/视频里的文字念不出来"的痛
500Python人工智能
本项目是一个本地AI系列视频工作台,核心功能覆盖从内容策划到视频导出的完整链路。系统支持领域、系列、主题、Episode、分镜、素材等多层级内容管理,用户可以先建立行业领域,再配置系列的人设、受众、讲述语气、视觉风格、内容结构和禁忌规则,保证多期视频风格统一。围绕某个主题,系统支持AI生成大纲、脚本
670HTTP音视频多媒体
浏览、搜索、排序本地视频目录。按目录、标签、收藏组织视频,支持多标签交集筛选。使用FFmpeg生成缩略图。缓存视频时长、分辨率、编码等元数据,并使用扫描索引加快再次打开视频库。使用mpv播放常见桌面视频格式。支持深色/亮色主题。支持手机端扫码绑定电脑。手机端可在局域网内浏览电脑视频库。手机端提供沉浸
520JavaScript音视频多媒体
•AI穿搭推荐—输入身材数据+风格偏好,DeepSeek大模型实时推荐搭配方案•淘宝联盟深度集成—推荐商品直接链接淘宝下单•身材分析—拍照或手动输入三围,自动判断身型并匹配合适款式•佣金系统—推荐好友使用获得40%佣金分润,提现到支付宝•社交分享—分享穿搭方案到微信/朋友圈,好友通过推荐码注册双方获
530Java电商
• 导播台:音频分组管理,支持拖拽排序、多种播放模式• 语音播报:定时自动播报,支持9种中文语音• 背景音乐:多任务独立运行,支持时段控制• 即时插播:一键播报,插播时自动降低背景音乐音量• 定时关机:支持指定时间/延时关机/重启/休眠/注销• 系统托盘:最小化到托盘后台运行• 深色主题界面,操作简
450Python音视频多媒体
https://zrq2.batch.icu/posts/qt-media-player-v1/https://zrq2.batch.icu/posts/qt-media-player-v1/https://zrq2.batch.icu/posts/qt-media-player-v1/https:
630C++音视频多媒体
写词/管词:用配置好的歌词大模型(如DeepSeek)生成歌词,曲库里维护「仅歌词→生成音乐→去痕/转码」等状态;歌名会与曲库去重、两阶段起名+写词等逻辑。生成音乐:对接Suno/TTAPI等云端或本机流程,排队生成、下载、入库。后期与物料:FFmpeg去痕、转码、整理发布用物料(音频、歌词、封面等
1160Python人工智能
实现Windows平台下ComfyUI与StableDiffusion深度学习绘图框架搭建。封装Bat/PowerShell脚本自动化启停脚本,内置显存优化策略,同时汇总环境配置、版本兼容、依赖报错等全套落地排坑方案,实现开箱即用的私有化AI绘图服务。
1330Python人工智能
AIVideoFactoryPro是一个面向自动化视频生产的AI视频工厂项目。它以统一的Director调度器为核心,把剧本解析、角色与台词管理、镜头提示词生成、图片一致性、视频生成、桥接片段、语音合成、口型同步、质量检查和最终合成都串在同一条生产流水线中。项目支持从剧本文件和项目配置出发,自动管理
1170postgres工业互联网
1.48kHz录音室级音色克隆:利用本地4090算力,实现对特定人声的超高还原度建模,彻底跨越“恐怖谷效应”,支持多语言身份对齐。2.VLM视觉自愈RPA:引入视觉语言模型导航,AI像人眼一样识别UI界面,彻底摆脱脆弱的CSS/DOM选择器,网页改版逻辑自动适配。3.HITL人机协同安全锁:通过3D
1010Java音视频多媒体
1.实时音频响应矩阵:基于WebGL实现毫秒级的音画同步,AI的每一声回应都会在视觉场中产生物理级精确的波动反馈。2.电影级视觉氛围:通过定制Shader营造crystalline(晶体感)交互场,利用魔术心理学线索引导用户注意力,彻底消除视觉违和感。3.动态感知架构:模拟生物律动,赋予AI智能体“
950Java音视频多媒体
项目采用画布节点化设计,核心功能模块包括:1.**智能画布系统**:支持图片上传、拖拽编排、节点连线,提供缩放、平移、多选等丰富交互能力2.**AI图像生成**:集成多种主流AI图像模型(如Midjourney、DALL-E等),支持文本生成图像、图像编辑、风格迁移等能力3.**工具处理链**:内置
1650TypeScript音视频多媒体
VDD的设计哲学是:**简单、快速、不打扰。***极简主义设计:没有乱七八糟的广告,没有复杂的弹窗。侧边栏导航,逻辑清晰,打开就能用。*原生性能怪兽:基于Go+Fyne开发,编译为原生二进制文件。内存占用低,启动速度快,不像Electron应用那样吃内存。*订阅自动下载:(v1.4.0重磅功能)支持
1470Go工业互联网
基于Node.js与ffmpeg的B站视频解析与下载工具,支持提取多清晰度视频音频流并一键合成MP4,界面简洁易用。fluent-ffmpeg:用fluent-ffmpeg来调用ffmpeg,把DASH的视频流和音频流合并成一个MP4文件。
1430Java音视频多媒体
当前共21个项目more
×
寻找源码
源码描述
联系方式
提交