AURA:将LLMs连接到SRE生产工作流的代理平台
AURA由Mezmo提供,是一个生产就绪的代理平台,将大型语言模型与站点可靠性工程工作流程连接起来,将模型输出转化为受控的操作行为。该工具运行代理以诊断事件、分析日志并提出修复建议,同时强制执行身份验证和批准门。它包括遥测钩子、多模型编排和用于私有文档的向量基础。平台工程师和SRE团队获得了一种自动化常规操作工作的方式,同时保持操作员的监督和可追溯的活动。
你实际上可以用它做什么任务?
AURA 作为一个代理工具,运行基于模型的工作流,针对实时可观察性系统,而不仅仅是对话测试。该平台包括 API 服务器、状态管理和流媒体,因此代理可以执行具体的 SRE 任务,例如事件诊断、日志分析和受控修复。可调用工具的示例包括集成到管道中的可观察性来源和警报平台,这使得代理能够从遥测中提取可操作的发现。
代理的输出在操作工作中有多可靠?
AURA 强调通过经过生产测试的保护措施和可配置的人类批准门来确保操作安全。该系统可以将过大的工具输出存储在磁盘上,以避免上下文窗口的洪水,并使用向量搜索基础与 Qdrant 或 AWS Bedrock 知识库等存储结合,将响应与私有文档联系起来。这些控制措施降低了风险,防止未经验证的自动更改在没有人类签字的情况下进入生产环境。
它接受什么输入和连接,限制在哪里?
该平台使用模型上下文协议进行动态工具发现,可以通过 HTTP、SSE 或 STDIO 调用任何符合 MCP 的服务器。它支持大型工具输出,通过持久化结果并允许代理仅获取所需的切片。调度器接受跨云和本地运行时的模型后端,包括 OpenAI 端点、Anthropic、AWS Bedrock、Google 模型端点,以及通过 Ollama 的本地模型,从而支持混合模型工作流。
它适合典型的 SRE 工作流和部署模式吗?
AURA 是一个基于 Rust 的应用程序,作为 CLI 驱动的本地环境进行开发,并作为生产的服务器组件进行部署;它还支持本地或隔离的设置。配置使用 TOML 来定义专业工作者和模型路由,原生 OpenTelemetry 集成导出跟踪以监控代理性能。开源分发使得该堆栈可扩展,适合希望在内部运行完整系统的团队。
AURA 是一个面向生产的选择,适合具有平台能力的工程团队
AURA 适合需要受控代理自动化并准备操作编排堆栈的 SRE 和平台工程团队。由于该项目旨在运行在客户基础设施上,并且需要服务器部署和模型路由配置,因此没有平台工程资源的团队应该预期会有非平凡的设置和维护负担。对于能够托管和配置堆栈的团队,AURA 提供了一条在人工监督下自动化操作任务的可追溯路径。
