陈思远 · Algorithm Engineer
个人总结
资深算法工程师,近5年成功实现从学术研究到工业落地的转型,专注AI算法在电商与推荐场景的规模化应用。主导多模态搜索、推荐系统CTR/CVR多任务学习、大语言模型微调及模型轻量化等核心项目,实现搜索召回率提升17%、推荐GMV增长5%、模型推理延迟降至35ms以下。精通PyTorch/TensorFlow生态下的模型压缩(知识蒸馏、量化)与工程化部署(Docker、vLLM、A/B测试),具备支撑日均千万级高并发请求的实战经验。在NLP、多模态检索、强化学习与优化算法领域拥有完整技术栈与团队管理能力,持续推动算法在电商推荐与搜索场景的价值落地。
工作经历
主导研发基于BERT的文本分类引擎,针对电商客服场景完成数据清洗与标注,构建10万级高质量语料库,模型F1从0.82提升至0.91。使用PyTorch实现BERT轻量化改进(知识蒸馏+动态量化),模型体积压缩60%,推理延迟从120ms降至35ms,线上QPS提升3倍。采用Flask封装推理接口并设计异步请求队列,配合Docker容器化部署,支持弹性扩缩容,峰值吞吐达2000 QPS,服务可用性99.95%。搭建离线评估+在线A/B测试框架,通过7天灰度对比验证新模型CTR提升4.2%,并建立回滚机制保障上线无事故。设计多版本模型热切换方案,利用Redis缓存高频查询结果,命中率达65%,平均响应时间进一步降至18ms。编写工程化文档与监控看板,建立模型版本管理、特征日志采集、异常告警体系,使团队后续迭代效率提升40%
主导推荐系统CTR/CVR模型从单目标双塔升级为多任务学习框架,引入用户长期行为序列与实时上下文特征交叉工程,在TensorFlow上完成训练与部署,经A/B测试验证主推荐流CTR提升0.8%、CVR提升1.5%,日均有效点击量增长2.3%。针对冷启动物品曝光不足问题,设计基于元学习的特征生成网络,利用实时反馈数据动态调整特征权重,使新商品7日内曝光量提升12%、CTR冷启动阶段提升1.1%,显著缓解物品冷启动瓶颈。重构特征工程管线,新增用户实时兴趣画像、跨会话行为序列与分桶离散化策略,离线AUC提升0.6%,线上CVR提升0.9%,同时将特征更新延迟从小时级压缩至分钟级。主导A/B测试框架优化,建立多指标监控体系与自动分流机制,推动模型迭代实验效率提升30%,年内累计通过模型迭代为推荐场景贡献约5%的GMV增长
主导多模态搜索算法研发,基于CLIP模型融合视觉与文本特征,构建多模态embedding,并引入Faiss构建近似最近邻索引,使搜索召回率从72%提升至89%,相关商品点击率提高15%。针对大模型推理延迟问题,采用知识蒸馏将CLIP模型压缩为轻量级版本,结合TensorRT优化,使单次搜索响应时间从350ms降至80ms,同时保持95%以上召回精度。设计离线评估与在线A/B实验体系,通过多阶段负采样与难例挖掘策略,将搜索排序的NDCG@10提升8%,并在双十一大促中支撑日均千万级搜索请求,零故障。联合标注团队构建百万级图文配对数据集,采用对比学习预训练,使跨模态检索准确率提升22%,并成功集成至搜索引擎主链路,带动搜索转化率提升6%
主导企业知识问答垂直场景的大语言模型微调,采用LoRA将可训练参数量压缩至原模型0.1%,在保持95%准确率的前提下将单次微调训练时长从72小时缩减至14小时。部署vLLM推理框架替代原生HuggingFace实现,应用PagedAttention动态批处理机制,将在线推理吞吐量从60 QPS提升至240 QPS,P99延迟控制在180ms以内。设计系统性Prompt Engineering流程,包含Few-shot和Chain-of-Thought模板组合,将复杂任务(如合同条款解析)的首次回答准确率从65%提升至92%,同时减少10%的token消耗。实施混合精度量化(FP16→INT8)与知识蒸馏联合压缩方案,将7B模型体积从13.5GB降至6.8GB,推理速度提高2.3倍,端到端精度损失仅0.8%。搭建自动化微调与评测流水线,集成LoRA适配器热加载与A/B测试模块,支撑多版本模型周级迭代,将模型从训练到上线的平均周期由2周压缩至3天
项目经历
针对公司内部IM系统日均数十万条对话中的负面舆情爆发问题,作为算法负责人主导设计基于LSTM与TextCNN双路融合的情感分析模型,通过Kafka实时消费消息流并部署在GPU推理集群上,实现对话级负面情绪实时识别,准确率达92.3%、召回率88.7%,单条推理延迟控制在45ms以内。为缓解标注数据稀缺,带领团队构建包含12万组对话样本的情感标签体系,采用半监督学习策略(伪标签+对抗训练),将模型在冷启动场景下的F1分数从0.61提升至0.85,同时削减人工标注工作量60%。基于Kafka的分布式流处理架构设计滑动窗口聚合机制,动态检测5分钟内连续出现高强度负面情绪的会话并触发自动预警,使客服介入响应时间从平均8分钟缩短至90秒,负面情绪升级率降低37%。上线后通过A/B实验验证:实验组用户7日内主动投诉率下降22%,群聊解散/退出事件减少18%,模型每百万条消息的误报率仅1.2%,保障业务方对告警信噪比的核心要求
针对订单履约平台日均数万订单动态调度场景,路径规划算法因缺乏全局优化导致配送时长偏高,主导设计基于遗传算法与模拟退火混合的离线优化引擎,结合历史订单热力图构建初始种群,并融入MapReduce并行框架加速求解,使路径规划耗时从30秒降至2秒,同时缩短平均配送时长18%。为应对实时订单插入与交通拥堵,提出强化学习驱动的在线调整策略,以配送员状态和路网拥堵为状态空间,使用Q-Learning动态重规划剩余路径,在高峰时段将订单准时送达率从82%提升至94%,并降低10%的无效里程。针对GPS信号漂移导致路径匹配错误,引入隐马尔可夫模型(HMM)地图匹配算法,融合路网拓扑与实时轨迹点,将路径匹配准确率从78%提升至96%,减少因绕路造成的额外配送时间约12%。进一步优化多目标冲突(时效、成本、里程),构建带精英保留的NSGA-II多目标遗传算法,将单均配送成本降低14%,同时保持平均配送时长在28分钟以内,支撑平台单日订单处理能力提升至20万单
针对原有规则匹配系统处理复杂意图准确率低、用户自助解决率仅62%的问题,作为技术负责人主导基于BERT的意图识别与槽位填充系统重构,利用Rasa框架搭建NLU Pipeline并微调预训练模型,使意图识别准确率达93%、槽位F1值提升至0.89,用户自助解决率提升至78%,人工客服转接量下降35%。深入分析多轮对话中上下文缺失导致的槽位错误,设计基于BERT的对话历史编码模块融合上下文特征,将多轮槽位填充准确率从72%提升至85%,单次对话平均轮次由4.2降至2.8,用户满意度评分提高12个百分点。为支撑日均50万+对话请求的低延迟处理,主导模型推理优化,采用ONNX Runtime加速与INT8量化,将单次推理耗时从120ms压缩至28ms,系统吞吐量提升4倍,同时保持99.2%的线上服务可用率
面对亿级商品图片及文本描述的多模态检索需求,作为算法负责人从零构建图文双塔模型,采用对比学习(InfoNCE loss)联合训练图像与文本编码器,在离线Recall@10上达到92.5%,相比基线(仅文本检索)提升18个百分点。针对线上延迟敏感场景,设计粗排(向量检索+GPU加速)与精排(交叉注意力重排序)两阶段流水线,将单次检索p99延迟从120ms压至48ms,同时精排阶段NDCG@20提升7.2%。主导融合图像颜色、纹理与语义特征的混合索引方案,利用乘积量化(PQ)与倒排索引压缩向量库至1.2GB,实现1000 QPS下的高并发以图搜图,搜索转化率(CTR)较原有方案提高9.1%。为支撑跨模态检索(文本搜图、图文混合查询),改进双塔输出为共享语义空间,引入难负样本挖掘策略,使跨模态召回率(Recall@50)达86.3%,并在A/B测试中推动推荐场景人均GMV增长5.4%。统筹4人团队完成多模态检索平台上线,搭建线上监控与离线评估体系,通过GPU算子融合与ONNX Runtime部署将模型推理吞吐提升3.2倍,月度服务调用量突破2亿次
教育经历
专业技能
荣誉奖项
因推荐系统CTR提升12%获公司级奖项
多模态搜索项目获得部门年度最佳实践
Sample data, for reference only
Try a different style
Pick a style you like and create your resume in one click

















































