没有找到合适作品,全国有 1115805 名开发者可以为您开发,您可以 查看全国开发者 或者 发布您的需求

优秀作品推荐

1.持续收音:手机麦克风实时采集,基于自适应噪声底的能量检测自动断句,对方停顿0.8秒即判定一句话说完,句首预留300毫秒避免吞字;2.语音识别:整句音频送OpenAI兼容的/audio/transcriptions接口;3.大模型回答:流式调用/chat/completions,保留最近6轮上下文
70Android人工智能
系统包含四大核心模块:1)内容监听与抓取:支持TikTok等海外平台按关键词或指定账号进行自动扫描监听,实时发现热门视频并批量下载,支持增量更新和去重过滤;2)视频智能去重:基于FFmpeg的多层处理流水线,包含帧率调整、色彩矩阵变换、轻微随机裁剪、音频重采样、HDR转SDR等手段,生成平台无法识别
70Python音视频多媒体
系统覆盖每日推荐、私人FM、视频信息流、相似内容推荐四大场景,包含五层功能模块。①多路召回层:ItemCF/Swing协同过滤、深度双塔(音频与封面特征)、实时会话i2i、热门新星兜底;②排序层:粗排双塔蒸馏与精排MMoE点击/完播/时长多目标建模,并将协同过滤共现分与置信度作为特征注入精排;③重排
150Python音视频多媒体
1)剧本结构化:解析场次、人物、动作与状态,形成可机读的场景/镜头骨架。2)分镜资产生成:按镜输出镜头定义、连续性描述与语义状态(不只是一段文案)。3)多渲染器提示词:针对不同图像/视频模型生成可切换的提示词与参数建议,避免一套prompt绑死一家模型。4)批量任务:整本剧本批量出分镜、批量重跑失败
250Python内容平台
全链路实时语音:麦克风WebRTC采集→SileroVAD(含500ms预回填,降低开口丢字)→流式STT→LLM流式生成→流式TTS→WebAudio播放;说话即打断(barge-in),用户插话立即停生成、停发声并重新监听,无需等AI说完。Provider中立:STT/LLM/TTS统一接口,1
220Python人工智能
项目主要包含以下功能模块:1)音乐模块:扫描指定目录入库(支持mp3/flac/wav/ape/ogg/aac/m4a/wma),自动解析ID3元数据(标题、歌手、专辑、时长);支持"默认/喜欢"系统歌单与自定义歌单、播放列表密码锁定;播放栏支持顺序/列表循环/单曲循环/随机四种模式、进度拖动、音量
220Vue音视频多媒体
1)首页推荐与轮播;2)电影/电视剧/综艺/动漫/短剧五频道+类型/年份/地区筛选+语义化分页;3)影片详情含评分、演员、剧情、相似推荐、同类热门;4)去哪看导航页分普通影视与短剧双逻辑,短剧定向抖音/快手搜索;5)专题/影评指南/榜单/搜索含无结果6宫格推荐;6)用户追更、片单、播放历史;7)SE
240HTML5音视频多媒体
现有30+功能模块:图片批量压缩、格式互转、九宫格拼图、二维码生成、社媒封面裁剪、水印添加、金句卡片;PDF合并拆分压缩转图片加密;JSON格式化、Base64编解码、密码生成器、颜色选择器、时间戳转换、文本对比;AI证件照换底、AI智能抠图、AI去水印、语音转文字、AI文案助手、招投标助手;房贷、
250小程序音视频多媒体
●远程驾驶:操作员在远程座舱内,通过方向盘、踏板、实体按键等操控矿卡,实现转向、制动、举升等动作,操控体验接近现场驾驶。●超低时延视频回传:1080P环视影像实时回传至座舱屏幕,端到端延迟≤120ms,操作员几乎无感知延迟,保障操控信心。●弱网自适应:矿山网络抖动大、带宽不稳定,系统具备抗弱网能力,
210C++音视频多媒体
平台分三套子系统。智能调度系统含指挥调度、会议应用、应急指挥调度、工作安排、视频监控和电子地图,支持集群对讲、视频会议、会议室预约和值班排班;处理系统含资产、事件和应急指挥,负责资产台账与事件处置;场地管理系统含资产管理、资产可视化、集中监测和集中联动控制,联动覆盖空调、照明、电源、门禁、窗帘、升降
330Java音视频多媒体
×
寻找源码
源码描述
联系方式
提交