职责描述
岗位职责
- 参与数据生产管道开发,包括标注算法
- 编写 SQL / PySpark 完成离线/实时数据处理任务
- 协助完成数据质量监控与指标看板搭建
- 协助进行模型性能分析、误差诊断与优化迭代
任职要求
- 计算机、软件工程、数学、统计、人工智能等相关专业在读本科生或研究生
- 熟练掌握 Python,具备良好的编程习惯与代码风格
- 熟悉 PySpark/SQL,能够独立完成多表关联查询与数据清洗
- 了解机器学习/深度学习基础知识,熟悉 PyTorch 或 TensorFlow 任一框架
- 最少实习4个月,每周最少4天
加分项
- 有基于分布式架构(如Ray)的模型训练/微调经验
- 有Agent开发经验,了解 LangGraph、LlamaIndex、AutoGen 等 Agent 框架