- 工作类型:全职
- 职位类别:软件算法类
- 职位学历:本科
- 招聘人数:若干
- 更新时间:2026.07.21
- 工作地点:上海市-浦东新区
职位描述
1. 构建AI就绪的数据架构与本体建模方法论: 主导企业级数仓与AI语义层的顶层设计。突破传统维度建模局限,引入本体建模方法论,将半导体/高端制造场景中复杂的设备、工艺、物料、指标及其关联关系进行结构化语义抽象,构建标准化业务知识图谱,为AI大模型与Agent提供清晰的业务认知底座。
2. 主导实时数仓与湖仓一体演进:规划并落地下一代实时数据架构,基于流批一体技术栈,构建端到端的秒级/毫秒级数据流。保障实时监控、实时预警及AI Agent在线调用场景的高并发与低延迟响应。
3. AI Agent数据工程落地: 全面负责AI Agent在数据领域的工程化落地。设计并开发Agent可调用的数据工具链,将复杂的SQL查询、实时指标计算、归因下钻过程封装为标准化API服务,实现大模型与底层数仓的安全、高效交互。
4. 智能数据服务体系规划与治理:制定数据服务的中长期演进路线图,结合本体知识库与RAG(检索增强生成)技术,推动传统数据平台向“对话式智能数据助手”升级。建立涵盖“传统数据质量”与“AI输出质量”的双轨治理机制,设计数据校验拦截策略与人类反馈强化(RLHF)的数据回流链路。
5. 全生命周期管理与业务赋能:建立标准化的数据与AI需求全生命周期管理流程。主动挖掘业务在数据获取与分析中的卡点,利用AI辅助工具将海量数据转化为高价值的业务洞察,驱动业务决策模式从“人找数据”向“数据找人”转变。
职位要求
1. 本科以上学历,计算机科学、人工智能、大数据技术、统计学等相关专业。
2. 精通实时数仓技术栈:具备大规模实时数仓架构经验,熟练使用 Apache Flink 进行流批一体数据处理与复杂事件计算;精通 Kafka 等消息中间件;精通 Apache Doris 或 StarRocks 等高性能实时MPP分析型数据库,具备极强的大规模数据SQL调优及查询性能优化能力。熟悉湖仓一体架构及组件者优先。
3. 具备本体建模与知识工程能力:深刻理解并熟练运用本体建模方法论,具备业务知识图谱构建、语义网设计、RDF/OWL或图数据库(如Neo4j/NebulaGraph)的实战经验,能将复杂业务逻辑转化为机器可读的语义模型。
4. 具备行业专家级的AI数据工程经验: 深度参与过大模型(LLM)在企业内的数据类应用落地;熟悉RAG架构,具备文本数据向量化、Prompt工程与语义对齐的实战经验。
5. 具备AI Agent数据工具链落地经验: 熟悉LangChain、LlamaIndex等主流Agent开发框架;深刻理解Function Calling机制,有将复杂数据查询、指标计算等动作封装为Agent Tools并成功上线的实战案例。
6. 具备卓越的跨界沟通与协调能力,能够作为桥梁无缝对接算法团队、IT开发团队与核心业务部门,推动复杂AI数据项目从概念走向落地。
7. 具备多年以上数据仓库建设或数据平台架构经验,有半导体、高端制造或大型工业互联网行业背景者优先。