AI数字化工程师 (武汉)
岗位职责:
工作职责涵盖多个方向,应聘人员具备以下任一方向相关经验、能力匹配即可:
1、参与语言 / 多模态大模型架构设计、训练微调、蒸馏量化、分布式训练与推理优化,完成数据处理、模型训练、部署上线全流程工作;跟踪大模型前沿技术,探索多模态、模型轻量化方案,结合业务落地 AI 应用,开发 AI 技能工具提升交付效能;
2、参与 AI 算力基础设施(GPU 服务器、集群、云资源)现场实施部署、模型调试、数据标注与验收测试,跟进项目问题闭环,整理交付文档,支撑 AI 算力项目落地;沉淀交付标准与最佳实践;
3、负责交付服务业务数字化方案设计,推动数字化需求落地,促进各产品线数字化体系落地;
4、承担 ERP 二次开发、ERP 与 OA/WMS/ 电商等系统集成开发;负责环境部署、上线运维,开展 SQL 及系统性能调优,处置线上故障,沉淀开发与集成解决方案。
岗位要求:
1、计算机、人工智能、软件工程、管理科学与工程、信息系统与信息管理等相关专业;
2、良好的问题分析、故障定位能力,具备技术文档撰写能力;优秀跨团队沟通协同能力,抗压能力强,能够适应项目出差。
3、工作职责涵盖多个方向,应聘人员具备以下任一方向相关经验、能力匹配即可考虑:
1)熟练使用 Python/Java,掌握 PyTorch/TensorFlow,熟悉 Git 开发工具;了解 Spring Boot 微服务、Redis,掌握至少一种关系型数据库(Oracle/MySQL/GaussDB 等),可进行 SQL 编写、存储过程开发与 SQL 性能调优;
2)深入理解 Transformer、LLaMA 等大模型架构,熟悉注意力机制、位置编码等核心模块;掌握大模型全流程工作:数据清洗、预训练、指令微调、模型评估;了解 QLoRA 量化蒸馏、vLLM/TensorRT 推理加速、CLIP/LLaVA 多模态方案;
3)有 LLaMA/ChatGLM/InternLM 等开源大模型项目经验,或 Megatron、DeepSpeed 分布式训练框架使用经验优先;
4)具备 ERP 二次开发、系统集成开发经验优先,能够排查线上系统故障;
加分项:
1、熟练编写 Shell/Python 脚本,掌握 Ansible 等工具实现服务器自动化运维;熟悉 Docker、Kubernetes,拥有阿里云 / AWS 等公有云运维、资源编排及成本优化经验;可基于 Prometheus/Grafana、ELK 搭建监控与日志体系,具备系统安全加固、故障排查能力;拥有 MySQL 调优、高可用集群部署经验,熟悉国产操作系统、中间件适配优先。
2、有 AI 相关论文发表,或参与具身智能、机器人控制等跨领域项目;ACM/NOI 赛事获奖、Kaggle 取得靠前名次,或在 Hugging Face 拥有开源项目贡献优先;
3、学习能力突出,逻辑思维良好,具备较强技术钻研热情,擅长攻克复杂技术问题。