🛠️ SRE (站点可靠性工程师)
站点可靠性工程专家,精通 SLO、错误预算、可观测性、混沌工程和减少重复劳动,守护大规模生产系统的稳定性。
工程研发研发团队🔧 关键规则三大支柱
开发周期
5-15天
实施难度
进阶
适合
研发团队
问题
- SRE (站点可靠性工程师)相关工作仍大量依赖人工经验,难以复用和规模化。
解决方案
- 🔧 关键规则
- 📋 SLO 框架
- 🔭 可观测性体系
- 三大支柱
- 黄金信号
工作流程
- 01🔧 关键规则
- 02📋 SLO 框架
- 03🔭 可观测性体系
- 04三大支柱
- 05黄金信号
技术架构
输入
业务目标、现有资料、约束条件
Agent
SRE (站点可靠性工程师)
工具
代码仓库、CI
输出
性格 :数据驱动、主动出击、痴迷自动化、对风险务实
实施方式: LLM + Tool Calling
输入
- 业务目标
- 现有资料
- 约束条件
输出
- 性格 :数据驱动、主动出击、痴迷自动化、对风险务实
- name: 可用性
- severity: critical
技术栈
- LLM
- Prompt
- Tool Calling
- 代码库
- CI
API
- 代码仓库
- CI
GitHub
https://github.com/jnMetaCode/agency-agents-zh/blob/main/engineering/engineering-sre.md项目报价
参考项目 ¥15,000 - ¥50,000。这是按当前案例范围做的实施估算,随系统接入深度变化,不是市场统一价格。
常见问题
SRE (站点可靠性工程师)适合什么企业?
适合研发团队团队,用来把「站点可靠性工程专家,精通 SLO、错误预算、可观测性、混沌工程和减少重复劳动,守护大」变成可重复的流程。
需要准备什么?
准备业务目标、现有资料,以及对应的代码仓库。
开发周期怎么估?
按当前案例范围,参考周期是 5-15天。报价随系统接入深度变化。
类似案例
工程研发
🧹AI 数据修复工程师
自愈数据管道专家——使用气隙隔离的本地 SLM 和语义聚类,自动检测、分类和修复大规模数据异常。专注于修复层:拦截坏数据、通过 Ollama 生成确定性修复逻辑,并保证零数据丢失。不是通用数据工程师——而是当你的数据出了问题且管道不能停的时候,出手的外科手术级专家。
研发团队工程研发语义异常压缩零数据丢失保证
- 技术
- LLM · Prompt
- 周期 / 难度
- 5-15天 · 进阶
工程研发
🤖AI 工程师
精通机器学习模型开发与部署的 AI 工程专家,擅长从数据处理到模型上线的全链路工程化,专注构建可靠、可扩展的 AI 系统。
研发团队工程研发模型开发与训练模型部署与服务化
- 技术
- LLM · Prompt
- 周期 / 难度
- 3-7天 · 入门
工程研发
🔄自主优化架构师
智能系统治理专家,持续对 API 进行影子测试以优化性能,同时严格执行财务和安全护栏,防止成本失控。
研发团队工程研发关键规则工作流程
- 技术
- LLM · Prompt
- 周期 / 难度
- 3-7天 · 入门
想把这个 AI Agent 用到你的企业?
提交你的业务需求,获取 AI 落地方案。
免费咨询