在商业汇报、融资路演及企业培训等场景中,传统PPT制作耗时费力且模板化严重,而现有AI工具生成的PPT往往逻辑空洞、套话连篇,充满生硬的“AI味”,缺乏真正的专业美感。本项目立项旨在解决这一痛点,通过大模型与多智能体协作,打造一个能理解受众、具备专业叙事和克制审美的智能PPT共创平台,帮助用户在极短时间内高效产出有观点、有呼吸感、完全可编辑的高质量演示文稿。
点击空白处退出提示
在商业汇报、融资路演及企业培训等场景中,传统PPT制作耗时费力且模板化严重,而现有AI工具生成的PPT往往逻辑空洞、套话连篇,充满生硬的“AI味”,缺乏真正的专业美感。本项目立项旨在解决这一痛点,通过大模型与多智能体协作,打造一个能理解受众、具备专业叙事和克制审美的智能PPT共创平台,帮助用户在极短时间内高效产出有观点、有呼吸感、完全可编辑的高质量演示文稿。
平台包含需求分析、故事线策划、金句文案、视觉设计、多模态资产及魔鬼审校六大智能体模块。具体功能包括:支持对话式共创与A/B方案选择,实时解析用户意图;提供分页级文案与排版微调,支持上传品牌资产(Logo/字体/配色);基于RAG检索高级设计案例,智能生成配图与原生可编辑图表;最终一键导出PPTX文件。同时配备视觉与逻辑双审校机制,自动检查排版合规性与禁用词,彻底去除“AI味”。
我负责整体架构设计与核心智能体开发。项目采用 Python + FastAPI 作为后端框架,基于 LangGraph 构建多智能体状态图编排;接入 DeepSeek(深层次文案创作)与 GLM-4(任务调度与视觉理解)等国产大模型,利用 Milvus 向量库实现 RAG 设计知识检索,底层由 python-pptx 引擎生成文件,服务端使用 Docker 与 LibreOffice 部署渲染。实现亮点在于引入“文案与设计双向制约机制”以及“排版随机微调算法”,有效解决AI生成内容的僵硬感;主要难点在于多模型API的高并发调度、复杂PPT对象(图表/形状)的精准渲染,以及用户实时反馈循环(Human-in-the-loop)的流畅工程实现。



评论