Skip to main content

AI构建者(平台)

Technology
南京金斯瑞生物科技有限公司
南京市, 中国¥22,000 - ¥40,000 /月2周前截至 2026/11/18
全职

职位描述

该职位来源于猎聘 岗位职责 分层开发职责,负责其中一项或两项: 1.推理层开发

  • 为并发,时延,稳定性负责,实现高性能推理服务接口,支持同步/异步调用、流式输出、批量推理等模式
  • 开发请求调度与队列管理机制,优化并发处理能力与资源利用率
  • 实现推理结果缓存策略,降低重复请求的延迟与成本
  • 对接多种推理后端(vLLM、TGI、TensorRT-LLM、OpenAI API 等),统一接入标准
  • 优化推理链路性能,包括连接池管理、超时控制、重试机制、降级策略 2.知识层开发
  • 开发 RAG 检索增强生成核心模块,包括文档解析、分块、Embedding、索引构建
  • 实现向量检索服务,支持相似度搜索、多路召回、结果融合
  • 构建知识更新流水线,支持文档增量同步、版本管理、索引重建
  • 开发检索质量评估工具,追踪召回率、准确率、响应时间等指标
  • 实现答案溯源与引用标注,支持生成内容的可信度验证 3.模型层开发
  • 实现模型注册与元数据管理,支持模型版本、参数、依赖关系的记录与查询
  • 开发模型部署自动化流程,支持一键部署、灰度发布、滚动更新
  • 构建模型 AB 测试框架,支持多版本对比、流量分配、效果评估
  • 实现模型调用计费与配额管理,支持按 Token、按请求、按用户等多种计费模式
  • 开发模型性能分析工具,识别瓶颈并给出优化建议 4.观测层开发
  • 实现全链路日志采集与存储,支持请求级、会话级、用户级的日志查询
  • 开发核心指标监控面板,包括 QPS、延迟、错误率、Token 消耗、成本等
  • 构建分布式追踪系统,支持跨服务的调用链还原与性能分析
  • 实现异常检测与告警机制,支持阈值告警、趋势告警、异常模式识别
  • 开发运营报表系统,支持自定义维度分析与数据导出 任职要求 基本条件
  • 计算机、软件工程或相关专业本科及以上学历
  • 2年以上后端开发经验,有 AI 平台、大模型应用开发经验者优先
  • 熟练掌握至少一门主流编程语言(Go/Python/Java) 技术能力(具备其中一项或多项) 后端开发
  • 熟悉 RESTful API 设计与实现,了解 gRPC、GraphQL 等协议
  • 熟悉 MySQL、PostgreSQL 等关系型数据库,有 SQL 优化经验
  • 熟悉 Redis、Memcached 等缓存系统,了解缓存策略与失效机制
  • 熟悉 Elasticsearch、OpenSearch 等搜索引擎,有检索优化经验 分布式系统
  • 熟悉 Docker、Kubernetes 等容器化技术,有 K8s 运维经验
  • 熟悉消息队列(Kafka、RabbitMQ、RocketMQ)的使用与调优
  • 了解微服务架构,有服务治理、熔断降级、限流等实战经验优先
  • 熟悉云原生技术栈,有 AWS/阿里云等云平台使用经验 AI 相关
  • 了解大模型基本原理,熟悉 Transformer 架构与常见模型
  • 有 LLM API 集成经验,熟悉 Prompt Engineering 基础
  • 了解 RAG 技术栈,有向量数据库(Milvus、Chroma、FAISS)使用经验
  • 熟悉 LangChain、LlamaIndex 等框架者优先 可观测性
  • 熟悉 Prometheus、Grafana 监控体系
  • 熟悉 ELK/EFK 日志栈
  • 熟悉 Jaeger、Zipkin 等链路追踪工具 软性素质
  • 具备良好的代码习惯,注重可读性、可维护性、可扩展性
  • 有较强的问题分析与解决能力,能独立排查复杂问题
  • 有良好的沟通协作能力,能与多团队高效配合
  • 对 AI 技术有热情,愿意持续学习新技术

Keywords
monthsOfExperience: 24Apache KafkaGrafanaRedisMemcachedAccess tokenExtensibilityOpenSearchScalabilityGraphQLRabbitMQElasticsearchGRPCMysqlPostgresqlPythonSqlJavaAWSDocker

对这个职位感兴趣吗?