minapp1058289571
31分钟前在线
全职 · 1000/日  ·  21750/月
工作时间: 工作日22:00-23:00、周末09:00-18:00工作地点: 远程
服务企业: 0家累计提交: 0工时
聊一聊

APP聊一聊

个人介绍

1. 7年AI算法研发经验,聚焦音视频与多模态智能,具备视觉、语音、文本及大模型交叉算法能力,擅长复杂音视频场景的算法分解、多模态融合与系统设计。
2. 具备从数据构建、模型训练/微调、算法策略到工程落地的完整能力,主导多模态说话人识别、视频理解、多模态检索、音视频智能生产等项目,具备较强的复杂AI系统落地能力。
3. 熟悉LLM/RAG/Agent应用,具备意图识别、检索增强、工具调用及Workflow设计经验,能够将传统AI算法与大模型结合解决复杂业务问题。

工作经历

  • 2025-03-05 -2026-09-05马栏山音视频实验室算法工程师

    1.视频翻译与配音系统:主导多模态说话人识别、翻译策略优化及工程链路搭建,项目成为部门首个营收破百万的标杆工程。 2. 对话式大模型应用:负责简历智能查询系统(LLM/RAG)与端侧智能助手多轮对话系统(LLM/Agent),实现检索问答、意图识别与任务式对话,覆盖办公提效与C端

  • 2021-03-25 -2025-03-05芒果TV算法工程师

    1. 大模型研发和应用:深度参与芒果大模型备案全流程,主导拟人化模型训练、意图识别模型微调,并推动AIGC短片、平面广告、爱芒虚拟导演、小说智选等多个大模型应用项目落地,多次获公司S级绩优项目。 2. 多模态检索与智能生产:主导短-长视频检索、封面图检索、综艺自动拆条、有声剧语音

  • 2019-07-01 -2021-03-20百度算法工程师

    1. 算子编译与框架优化:主导Paddle2ONNX工具链研发,实现ONNX与Paddle模型互转及图优化(算子裁剪、融合),支持主流视觉模型转换,完善Paddle生态;同时参与Paddle2.0框架开发,优化算子及CPU/GPUKernel性能。 2. PaddleX多端部署S

教育经历

  • 2016-09-05 - 2019-07-05中南大学计算机技术硕士

  • 2010-09-01 - 2014-07-01四川大学光信息科学与技术本科

资质认证

技能

Torch掌握
0
1
2
3
4
5
作品
paddel2onnx

Paddle2ONNX工具链研发模块:负责底层算子编译与图优化,支持模型在ONNX与Paddle之间的相互转换。系统支持算子裁剪、算子融合等高级优化策略,能够有效缩减模型体积并提升推理速度。该模块覆盖面广,支持主流图像分类、检测、分割等视觉模型的平滑无缝转换,极大丰富了Paddle模型在外部生态的适

0
2026-09-06 19:36
视频翻译与配音系统

1.多模态角色身份识别模块:针对同人异名等痛点,系统融合了人脸、字幕、音频、视频等多模态信息。通过设计人脸过滤、聚类及跨集Embedding去重策略,实现了全剧“一人一名”的精准映射,说话人标注准确率高达95%。2.多角色智能翻译与Agent改稿模块:构建了说话人感知、语种规则与术语约束的翻译策略,

0
2026-09-06 19:31
更新于: 1天前 浏览: 3