个人介绍
我是程序员客栈的艺辉,一名 Python 算法工程师;
负责过强化学习训练平台、多智能体强化学习训练框架、AI 资讯智能检索与问答系统的开发;
熟练使用 Python、PyTorch、FastAPI、Docker、Kubernetes;
如果我能帮上您的忙,请点击“立即预约”或“发布需求”!
工作经历
2026-02-01 -至今西安领铄智能科技有限公司北京分公司python工程师
负责多智能体强化学习框架研发,支持 IPPO/MAPPO、并行采样、DDP、AMP、断点续训及 CPU/GPU/NPU 异构算力。 参与强化学习平台全栈建设,完成算法配置、实验管理、训练调度、模型管理、任务监控和可视化功能。 集成 Kubernetes、Argo、Ray、MinIO、Prometheus 等基础设施,建设训练任务调度、产物管理和监控链路。 建设基于 LLM 和 LangGraph 的 AI Agent 应用,实现数据采集、自动总结、全文检索、技能路由和流式问答。 基于 Ansible、Docker 和 Kubernetes 实现 ARM64/NPU 环境下的离线一键部署、增量升级、卸载和故障恢复。 负责跨服务接口、数据契约、性能优化和稳定性治理,解决连接池、超时、状态同步和资源泄漏等工程问题。
2025-06-15 -2026-01-31中科星图测控技术股份有限公司算法工程师
负责智能体推演与作战方案相关算法功能的开发与联调,持续推进模型输出与仿真/态势数据链路的打通,提升决策链路在业务流程中的可执行性与稳定性。 承担机器学习/强化学习平台场景下的算法工程化工作,参与训练流程搭建、模型导入接口开发、智能体库适配及模型推理结果接入,保障算法产物可在平台端可复现、可调优、可上线。 建设推演数据处理闭环:组织推演数据接入、预处理、历史样本对比、聚类分析与可视化展示,支持算法调试与异常复现,形成数据驱动的优化依据。 负责 NPU/VNPU 与异构算力环境下的算法适配与性能提升,覆盖单机/多机训练场景、资源监控、训练脚本改造与常见异常定位,降低平台算力问题对算法验证与上线的影响。 深入排查服务端算法链路问题,解决 grpc/http 协议兼容、跨域访问、环境依赖、推演服务稳定性等关键障碍,提升算法模块的可用性与回归通过率。 输出关键技术与交付文档(测试计划/报告、部署文档、技术说明),完善算法相关知识沉淀和交接机制,缩短团队后续复现与运维成本。
教育经历
2021-09-01 - 2025-06-15湖南信息学院软件工程本科





