ai ppt项目产品系统Vibe Coding

我要开发同款
l2026年07月26日
6阅读

技术信息

语言技术
JavaPythonVueTorch
系统类型
Web
行业分类
人工智能企业服务

作品详情

行业场景

PPT制作是职场高频需求,但传统方式耗时且设计门槛高。市面上的AI PPT工具大多生成图片式幻灯片,无法二次编辑,难以满足企业定制需求。本项目旨在解决"AI如何生成原生可编辑PowerPoint"这一核心问题。项目支持两种生产模式:一是"AI自由生成模式",从源文档(PDF/网页/DOCX)到最终PPTX全链路自动生成;二是"模板复刻模式",导入任意现有.pptx,提取为可复用SVG模板后由AI填充新内容,保留原版全部视觉设计。适用于企业汇报、咨询报告、教学课件、品牌发布等多场景。

功能介绍

项目核心围绕两种PPT生产模式构建功能模块:

【AI自由生成模式】从0到1创建PPT,包含:一、源文档转换模块,支持PDF/DOCX/网页/Markdown一键转Markdown,基于字体大小统计的标题推断算法智能解析;二、三角色AI Agent系统(Strategist策略规划、Image_Generator图片生成、Executor逐页SVG生成),支持8种画布格式和14个图片生成后端;三、SVG后处理流水线,图标嵌入(5库11600+图标)、图片对齐嵌入、文本扁平化、圆角矩形转路径四步单遍处理;四、SVG转PPTX引擎,将SVG元素精确映射为DrawingML原生可编辑形状,支持渐变填充、自定义几何、贝塞尔曲线逼近(误差0.03%)。

【模板复刻模式】从现有PPT复刻,包含:一、模板导入系统,从.pptx提取主题色、字体方案、媒体资产、页面结构,输出manifest.json;二、PPTX反向解析引擎,将OOXML形状树遍历转为SVG,处理主题色系统(schemeClr/prstClr);三、Mirror-mode填充器,不做占位符替换而是将模板SVG作为视觉参考仅替换文本内容,保留所有装饰元素和几何结构;四、模板资产库,20+布局模板和70个图表模板。

【通用能力】7种转场+23种入场动画、5个TTS旁白后端、本地SVG可视化编辑器、spec_lock.md设计规范锁定机制。

项目实现

本人负责项目整体架构设计、两种模式的核心引擎实现和AI工作流编排。技术栈为Python 3.10+,使用PyMuPDF做文档解析、python-pptx与原生OOXML XML操作做PPTX生成、numpy做数值计算、Flask做本地编辑器、curl_cffi做网页抓取。共118个Python脚本、37000+行代码。

架构亮点:一、选择SVG作为AI与PPT之间的中间格式——SVG与DrawingML共享绝对坐标2D矢量世界观,AI擅长生成SVG,工程转换保证确定性;二、两种模式共享同一套SVG→DrawingML转换引擎和后处理流水线,架构复用度高;三、spec_lock.md机制对抗长上下文中LLM的规格漂移,逐页重读设计规范;四、resume-execute工作流切割会话释放20-40K token上下文空间。

核心难点:一、AI自由生成模式中,SVG path命令到DrawingML的映射,弧线参数需离散化为贝塞尔曲线序列,非对称圆角矩形(rx≠ry)需custGeom+四段三次贝塞尔曲线逼近椭圆角,误差控制在0.03%以内;二、模板复刻模式中,PPTX主题色系统的反向解析(schemeClr/prstClr到SVG color的映射),以及master/layout/slide三层继承关系的处理;三、两种模式共用的tspan位置坐标扁平化——DrawingML文本模型无法表达同段落内坐标跳转,需将位置性tspan提升为独立text元素;四、OOXML动画时序XML的生成,涉及p14命名空间毫秒级时长控制和chrome元素自动识别排除。

示例图片

声明:本文仅代表作者观点,不代表本站立场。如果侵犯到您的合法权益,请联系我们删除侵权资源!如果遇到资源链接失效,请您通过评论或工单的方式通知管理员。未经允许,不得转载,本站所有资源文章禁止商业使用运营!
下载安装【程序员客栈】APP
实时对接需求、及时收发消息、丰富的开放项目需求、随时随地查看项目状态

评论