擅长 Python 自动化与 AI 视频工程,能够对接 LLM、文生图、文生视频、TTS 等 API,处理异步任务轮询、Webhook 回调、限流、超时、重试、幂等和失败恢复。熟悉 FFmpeg、ffprobe、字幕、音频拼接、封面生成与竖屏视频合成,可把脚本、提示词、素材生成、配音、剪辑、质量检查和发布串成可追踪的生产链路。具备 Windows、Docker、HTTP API、JSON、命令行工具和浏览器自动化实战经验,重视日志、manifest、成本记录、人工审核节点及密钥安全,能从 MVP 开始快速交付并持续迭代。
已落地一套 AI 短视频自动化生产系统:输入选题和口播脚本后,自动拆分镜头、优化提示词、调用图像生成接口、用 IndexTTS2 合成配音,再通过 FFmpeg 生成字幕、封面和最终视频,并执行技术质量检查与发布前审核。已有 1080×1920、约 76 秒、14 镜头的竖屏成片,运行清单记录每个模型请求、耗时、输出文件和失败边界;该成片已在抖音和快手完成真实发布。另有真人口播与右侧素材组合流程,覆盖音画合成、质量门禁、断点恢复及多平台发布。可按客户指定模型先交付单机 MVP,再扩展批量队列和更多模型。
本人独立搭建并持续维护的 AI 竖屏短视频自动化生产系统。系统以结构化脚本为输入,自动拆分镜头、生成提示词并调用图像模型,随后使用 IndexTTS2 完成配音,通过 FFmpeg 生成字幕、镜头运动、封面和 1080×1920 成片。流水线为每个模型请求记录耗时、输出文件、失败
本人独立搭建的 AI 真人口播视频自动化流水线。系统将选题和口播稿转为分镜计划,调用图像与素材接口准备画面,使用 IndexTTS2 生成配音并驱动数字人唇形,再通过 FFmpeg 完成字幕、右侧素材区域、关键词高亮、封面和最终合成。流水线包含文案门禁、音频质量检测、全片解码检查
本人开发并持续迭代的本地优先 AI 知识库工作台。系统支持粘贴文本、上传文件和连接器导入,将资料解析、分块后形成可检索的知识节点;提供关键词、语义与混合检索、GraphRAG、知识图谱、证据引用和知识健康检查。基于 Next.js、React、TypeScript、Indexed
本人开发的零依赖 API 链路诊断 MVP,用于快速定位 Linux 服务器、反向代理和第三方接口“访问失败”的真实边界。输入 HTTP/HTTPS 地址后,工具按 DNS、TCP、TLS/SNI、HTTP 四层逐步探测,并支持指定源站 IP 绕过 DNS 做对照验证,可识别 D
本人从零开发的价格监控与数据看板 MVP,不依赖第三方框架。系统通过 HTTP API 接收来自授权数据源的商品价格记录,使用 SQLite 保存历史数据,并在 Web 页面展示当前价、基准价、最低价、价格趋势和降价提醒。当最新价格较基准下降 10% 以上时自动标记机会;同时提供
本人从零开发的视觉助盲 AI Agent MVP,针对视障用户拍摄身份证时无法判断位置和角度的问题,完成摄像头或图片输入、证件轮廓检测、位置大小与旋转评估、中文语音指导和达标自动捕获闭环。系统基于 Python、OpenCV、NumPy 与浏览器原生 Web API 实现;服务端