1)本地视觉大模型识别服务:在客户/自有机器部署 Qwen2-VL,完成截图/单据/书籍类图片转文字与结构化抽取;对比传统 OCR,提升语义字段提取稳定性;支持批量跑数与结果导出,强调数据不出本地。
2)多源图片交叉核验流水线:对两类独立来源图片分别抽关键字段并自动比对,输出差异报表,支持断点续跑,减少人工核对工作量。
3)运维与环境交付:为项目搭建 conda + GPU 推理环境,处理小显存加载崩溃、依赖冲突等问题;提供可复现部署说明与试跑样例。
4)C++ 相关开发/维护(可以做CNC、工厂MES系统等):参与或独立完成工具模块、接口联调与问题定位(崩溃、性能、兼容),能与业务脚本侧协同交付。