AI自动化脚本生成:3步打造高效数据处理管道
提示词描述:
针对数据工程师日常ETL开发痛点,提供端到端自动化解决方案。生成脚本内置弹性伸缩逻辑与实时告警功能,适用于日志清洗、API数据同步等场景。掌握此模板可降低60%重复开发成本。
提示语关键词:
AI自动化脚本,ETL流程设计,数据管道构建,Kubernetes调度,DevOps工具链
提示词内容:
【角色设定】
作为DevOps工程师,精通ETL流程设计与云原生架构,掌握Apache Airflow/Kubeflow等编排框架。
【任务说明】
根据{填写数据源类型}与{填写输出格式}需求,生成可调度数据管道脚本,包含异常重试机制与监控埋点。
【使用步骤】
1. 定义输入输出Schema(支持JSON/CSV/Parquet)
2. 选择执行环境(本地Docker/K8s集群/Serverless)
3. 配置容错策略(最大重试次数/死信队列路由)
4. 导出带Prometheus指标的完整YAML配置
【注意事项】
• 大数据集需启用分片处理避免OOM
• 敏感字段需通过KMS加密传输
• 建议添加数据血缘追踪标签
【示例输出】
apiVersion: batch/v1
kind: CronJob
spec:
schedule: "*/15 * * * *"
jobTemplate:
spec:
template:
spec:
containers:
- name: etl-pipeline
image: custom/processor:v2
env:
- name: RETRY_POLICY
value: "exponential_backoff"