1. 企业级行为数据分析平台
技术方向:Python、R、LMM、SQL、自动化系统
负责系统整体数据结构设计、行为指标模型构建、变换/归一化策略
使用 LMM 重复测量模型 + 链式中介(X→M1→M2→Y) 构建系统干预效应检验
自动生成统计报告:ANOVA、效应量 η²/ω²、事后检验(Tukey/GH)
基于 Hive SQL + R/Python 构建 全自动分析流水线(清洗→建模→图表→报告导出)
**2. LLM 搜索排序与评测体系(个人研究/Side Project)
技术方向:Pairwise/Listwise、XGBRanker、数据样例构建
构建搜索排序训练数据:query、doc、点击/阅读/点赞等行为特征
使用 pairwise(A > B)、listwise(NDCG 优化) 构建排序训练集
用 XGBRanker + 特征工程提升排序效果(CTR/NDCG@k)
构建 自动评测脚本:召回率、MRR、精排效果对比
研究 LLM 在“不确定性问题”“文档排序解释”中的偏差类型
**3. 人才标签系统(内部 HR 大模型应用)
技术方向:Embedding、向量库、标签聚合、Docker 自建服务
将 360 反馈、绩效述职、周报等文本向量化,进行聚类与相似度检索
构建 自动标签抽取 pipeline:embedding → 聚类 → 匹配 → 投票
设计“按人头计数”“top-3 标签筛选”“跨周期合并”等规则
使用 Docker + FastAPI 自建内部服务,支持 HRBP 查询与可视化
**4. 多端自动化媒体流水线(短视频生产系统)
技术方向:Python、FFmpeg、MoviePy、TTS、自动化脚本
将字幕、音频、火柴人图层与背景图自动合成
设计无字幕/有字幕 pipeline、视频批处理、素材自动匹配
构建 TTS(Fish-Speech)+ ASR 校对的自动化口播生成
全流程自动输出:SRT → 音频 → 视频 → 上传包
**5. 微信小程序后端 + NAS 运行环境
技术方向:Node.js、Python 服务、数据库、Docker 部署
开发“雅思记单词”小程序后台服务
在 NAS 上部署后端服务、数据库、自动化报告生成脚本
构建安全访问方案:OpenClash、VPN、隧道、域名绑定
📊 数据分析案例(精选)
行为外显性 → 信任领导 → 组织认同 → 敬业度链式中介模型(大样本 10,000+)
随机森林用于组织行为预测(特征重要性 + SHAP 分析)
多时间点差异分析(LMM vs RM-ANOVA 对比)
样本量极不均衡(1:9)条件下的稳健推断与 bootstrap 重抽样