Agent Harness Engineer
Requires full-stack engineering and system design skills, experience with Cursor, Claude Code, and Codex, knowledge of LLMs, agent frameworks, prompt engineering, and practical AI agent development experience.
1、负责AI Agent全链路可观测体系建设,设计并实现Agent执行全链路的tracing & observability系统,支撑智能体行为复盘、问题定位与性能优化工作;
2、搭建并迭代Agent标准化质量评估体系,主导自动化eval pipeline、A/B testing、regression detection机制的设计与落地,实现Agent能力迭代的量化、可控、可追溯;
3、研发Agent debugging工具链,覆盖故障排查、链路还原、异常归因等核心能力,提升Agent迭代效率与问题修复效率;
4、参与Agent核心支撑平台的架构设计与研发工作,覆盖标注、SBS评测、数据管道等核心基建,保障Agent研发全流程高效稳定运转;
5、深度联动AI研究团队,跟进前沿大模型与Agent核心技术,落地大模型与Agent协同进化的前沿研究成果,驱动模型能力与智能体框架双向迭代、持续优化;
6、持续探索并落地前沿AI Agent工作流,沉淀可复用的工程实践与最佳方案,赋能研发全流程提效。
1、具备扎实的全栈工程能力与系统设计功底,拥有良好的代码规范与工程审美,编写的代码可适配人机长期协同维护,兼顾可读性、可扩展性与架构合理性;
2、重度使用Cursor、Claude Code、Codex等智能编码工具开展日常开发,对agentic coding的能力边界与failure mode具备一线实战经验与深刻体感;
3、熟悉AI/Agent技术栈,了解LLM、主流Agent framework、prompt engineering相关核心知识,掌握智能体运行与迭代核心逻辑;
4、具备优秀的极客精神,热衷探索前沿新技术,拥抱技术带来的生产力革新,具备较强的技术落地与实践能力;
5、对Code Agent的行业发展与落地形态具备独立、深度的思考,愿意深耕AI智能体领域,紧跟生产力变革趋势;
加分项:
1、拥有Agent Observability系统的开发或深度落地使用经验;
2、具备大模型智能体工程化、自动化eval pipeline、Agent回归检测体系搭建落地经验者优先。