岗位职责:
1. 参与大模型(如GPT、LLaMA、BERT等)的微调、部署及优化,提升模型性能和业务适配能力。
2. 开发基于大模型的应用系统,如智能问答、内容生成、Agent框架等,结合RAG、Prompt Engineering等技术解决实际问题。
3. 构建高效的数据处理与推理Pipeline,优化模型训练/推理效率(如LoRA、量化、分布式训练)。
4. 与算法、产品团队协作,推动AI技术落地业务场景,持续迭代产品体验。
岗位要求:
1. 学历与经验:
- 本科及以上学历,计算机科学、人工智能、软件工程等相关专业。
- 3年以上Python开发经验,至少1年专注于大模型应用开发(如LLM微调、部署、Agent开发等)。
2. 技术能力:
- 精通Python,熟悉PyTorch/TensorFlow,掌握异步编程、性能调优。
- 熟悉Hugging Face生态(Transformers、Datasets等),有LoRA/QLoRA微调经验。
- 了解大模型应用技术栈(如LangChain、LlamaIndex、RAG、向量数据库)。
- 具备模型部署经验(如vLLM、FastAPI、Docker/K8s)。
3. 加分项:
- 有分布式训练(Deepspeed、FSDP)或高并发服务开发经验。
- 熟悉云计算平台(AWS/GCP/Azure)及MLOps流程。
- 在GitHub、技术社区有开源贡献或技术博客。
4.软技能:
- 强烈的技术好奇心,能快速学习并应用前沿技术。
- 良好的沟通能力,能与跨职能团队高效协作。