独立软件工程师,专注隐私优先、端侧 AI —— 让敏感数据不出设备。
擅长:
Ai worker云服务配置运维
OCR+机器学习
OCR模糊结果与数据库匹配
为 iOS App、浏览器扩展、后端服务加装 LLM/RAG/Agent、视觉与 OCR 能力,用 BYOK 或纯本地模型,而非把用户数据路由到第三方云。
已上架一款 AI App Store 应用,独立完成 10+个项目(iOS 原生 App、Chrome MV3 扩展、FastAPI 网关与计量后端),涵盖支付、用量计量、应用商店上架全流程;也做过 VPS 加固与自托管 AI 工具部署(发布过一键安装器 + 安全巡检工具)。
github:github.com/Pelican0126

端侧、OCR感知的模糊匹配——在一帧充满噪声的OCR文本里,找出相机正对着的那一条记录。纯Swift、零运行时依赖。GlyphScan理解中文OCR到底怎么错的——因为它真的盯着字形看过。[OCR文本+bbox]←你的OCR(Vision或任何引擎;引擎无关)│预处理:归一化/分段/拆带权字段▼St
02026-07-01 08:49

一个ChromeMV3扩展:在你已登录的open.bigmodel.cn/glm-coding标签页内,于每日开售时刻(默认10:00:00Asia/Shanghai)检测补货(售罄→可购买的翻转),瞬时点击购买,把腾讯验证码交给人工完成(伴随响亮提醒),随后自动下单(create-sign)以占住
02026-07-01 08:42