半亩花草 发表于 2024-8-7 08:46:07

深度解析 | PagerDuty Copilot - 运维领域大模型应用场景

【本文作者:擎创科技资深产品专家 布博士】
最近一年多的时间里,生成式人工智能(我们通常称为大语言模型)已经成为了各行各业提拔服从的、低落成本的强盛工具。PagerDuty Copilot,作为一款为pagerduty cloud用户提供的生成式AI助手,已经在pagerduty cloud运营云中得到了广泛的应用。本文将深入探讨PagerDuty Copilot到现在为止,实现的四大主要应用场景。
事件辅助诊断AI助手

在事件发生时,PagerDuty Copilot可以大概帮助举行事件诊断。它可以提供事件的上下文支持,帮助识别影响因素和题目隔离,并提出调停路径,从而更快地解决题目。此外,响应者可以与PagerDuty Copilot互动,通过展示变动事件、建议的调停途径和其他可能的原因分析来举行观察。总的来说,PagerDuty Copilot可以大概减轻响应者的负担并自动实行时间密集型任务。

https://img-blog.csdnimg.cn/img_convert/5a027eaef29dfdbd29efd962c8f37334.png
事件的发生在大型分布式体系中是极其复杂的。在发生事件时,必要探讨和分析各种信息:


[*] 服务中断:这可能利用户无法访问或利用关键服务,从而可能影响用户的满足度和信托度。
[*] 各种警告:例如500错误、值机失败、航班延误、数据库响应滞后、存储响应不及时、应用无法访问等题目。
[*] 各种变动:失败可能是由于变动引起的。
[*] 客户投诉:包罗来自用户或内部员工的各种投诉信息以及他们收集的背景信息。
[*] 乱七八糟:各种信息都统一到事件工作台界面,难以短时间了解题目全貌。
在极短的时间内,人们很难全面了解这些信息,更不用说在这种事件或应急处理处罚的场景下。

https://img-blog.csdnimg.cn/img_convert/846aa3bd1a8e8cf9fe68eb7345150cc6.png
在这种背景下,pagerduty提供了pagerduty copilot的本领,如上图右侧所示,通过自然语言的问答模式,可以快速获取针对这些乱七八糟信息的快速洞察本领:


[*] 快速了解都发生了什么事情

https://img-blog.csdnimg.cn/img_convert/f2927854db5d6e7ff86d92ac0081b0a0.png


[*] 对客户的影响情况

https://img-blog.csdnimg.cn/img_convert/c3ec4b0a266c94bc4bff81fd34f2bd0f.png


[*] 题目产生的可能原因分析

https://img-blog.csdnimg.cn/img_convert/72958a8ecc47363a4b35e908d0dd18b5.png


[*] 自动化修复建议,生成修复后对客户的反馈分析,并人工审核和发送

https://img-blog.csdnimg.cn/img_convert/1af45cefb8c84744fefe3eeb70f7a6fd.png

https://img-blog.csdnimg.cn/img_convert/adcf09afffb7abeff3a48fc5eac3b1a0.png


AI生成事件状态更新同步干系人

在出现计划外的罢工或工作中断事件时,沟通和协调对于题目解决至关重要。行业最佳实践建议每30分钟(至少)向利益相关者和领导层举行定期状态更新,以确保企业以统一的声音回应。然而,制作这些更新必要时间,且在您的团队已经处于高压状态时,这将增加认知负担。我们有客户告诉我们,在庞大事件期间,他们会有三个人专门负责状态更新。
生成式人工智能的部署正是我们的开始。通过将生成式人工智能集成到我们的状态更新功能中,团队可以节省内容和对象的描述周期——仅需频频点击,他们就可以生成基于角色的状态更新草稿。新功能利用人工智能处理处罚与当前事件相关的全部数据并自动生成摘要,提供关于事件、进展和寻衅的关键见解。除节省时间外,此功能还增强了事件管理流程并简化了沟通,使您的团队可以大概更专注于解决题目的现实工作。
具体操作如下流程:


[*] 图1 - 在事件管理界面点击“generate status updates”按钮,进入图2
[*] 图2 - 点击“generate“按钮,会自动生成针对该事件的最新状态分析信息,并在下方可以预览生成之后的邮件格式

https://img-blog.csdnimg.cn/img_convert/a9ef8d5832dd07fc4c17d8aa9693ad43.png
图1 - 事件详情页

https://img-blog.csdnimg.cn/img_convert/4761e6b5cc5373895bc2cd87058f9c21.png
图2 - 生成和发送状态更新页


AI生成事后分析及总结陈诉

事后分析是卓越运营的主要内容之一,也是由站点可靠性工程 (SRE) 推动的最佳实践。它让您可以大概明白题目所在、找出可以改进的地方,最重要的是,它让您知道如何制止重复同样的错误。
然而,花费时间举行事后分析可能具有寻衅性。这是一个繁琐、手动的过程(有时带有情绪色彩),必要收集全部相关数据点供团队检察。
想象一下,有一组虚拟团队成员始终跟踪事件,他们的主要任务是为您的事后陈诉创建及时且公正的总结。这正是我们通过利用人工智能应用,自动创建全面的事件后总结陈诉所能提供的。

https://img-blog.csdnimg.cn/img_convert/abeaf99be01defa803919405e90d819a.png
如上图所示,一旦题目得到解决,用户可以选择生成事后分析陈诉。这将触发一个及时且耗时的数据收集过程,搜集全部与当前题目相关的可用数据,包罗日志、指标,以及相关的 Slack 或 Microsoft Teams 对话。然后,体系将生成一份详细的陈诉,包含主要发现、根本原因以及必要改进的领域。此外,PagerDuty 还会生成一份建议的举措项目列表,以防止未来发生类似题目。
此功能不仅可以节省时间,而且还可以为捕获关键知识提供一个起点,培养一连改进的文化,并使团队可以大概将更多时间花在面向未来的验证上,这让我们回到了人的重要性。当您批评关键任务工作时,利用循环方法来释放生成式人工智能的气力。
与上面的状态更新示例一样,自动事件事后分析必要一个人提供专业知识、判断和监督,验证和美满陈诉,然后再将其发布以供更广泛的利用。

https://img-blog.csdnimg.cn/img_convert/c01e5d623f4d8dadf63d4aa9cff12293.png
如上图所示生成了一份事后总结陈诉的草稿,并将必要填写的重要信息已经自动填写上。

https://img-blog.csdnimg.cn/img_convert/b2b088386fac0a20e6a597bef385d17f.png
事件的开始和截止时间以及涉及到的事件列表,也可以自行添加。

https://img-blog.csdnimg.cn/img_convert/0acc6bb208381eb4dd9e08328732ed9f.png
事件的发生的timeline信息。

https://img-blog.csdnimg.cn/img_convert/198cc232a9d282d36233c273ca4e8684.png
陈诉的总结以及都发生了什么的简要分析。

https://img-blog.csdnimg.cn/img_convert/6732bfab4e92b9ae0f330f316217791a.png
影响和触发题目的原因

https://img-blog.csdnimg.cn/img_convert/b057244082f38a68a01d7bac6e0709dd.png
经验考试和举措项
AI生成流程自动化

自PagerDuty Operations Cloud平台建立以来,他们不停在多平台利用自动化,并与众多人互助提供脚本和插件,以自动化工作流程,帮助客户更快地管理和解决计划外工作。他们的客户每天都在利用他们的服务,在云端和当地举行基础办法自动化,驱动Ansible、Terraform和Power Automate。然而,如果尚未有现成的脚本和工具,客户必要自己举行繁重的工作来编写脚本。
PagerDuty利用生成式人工智能作为用户自动化需求的实现者。这就像在用户团队中多了一位开发人员,他可以被分配去研究如何完成用户想要做的事情,然后为用户创建自动化。最重要的是,该体系可以利用用户最喜欢的脚本语言来完成任务,大概可以轻松地从一种语言转换到另一种语言,因此用户有完全的控制权。PagerDuty正在将低代码功能引入以往的高代码体验中,而不会失去任何功能或灵活性。例如,用户可以简单地声明:“编写一个自动化工作流程,将特定用户添加到Okta中的组中。我应该可以大概在运行时通过电子邮件和组指定用户。”点击生成按钮后,就可以观察结果。


[*] 生成自动化脚本

https://img-blog.csdnimg.cn/img_convert/c3e047eb85a56919bd2b1998ab7a9611.png


[*] 生成故障时,选择实行自动化脚本

https://img-blog.csdnimg.cn/img_convert/7715f3d01f9c5968b8197b4d05530492.png


[*] 查看实行过程

https://img-blog.csdnimg.cn/img_convert/2273e11d78913380541e847a3114952b.png
总结:PagerDuty Copilot所实现的高效、灵活、智能的运维辅助服务,是依赖于像ChatGPT-4这样的大模型的本领。这种大模型具有强盛的学习和明白本领,可以处理处罚大量的复杂信息,给出准确的反馈和建议。然而,当前我们看到的国内的大模型,要实现PagerDuty Copilot这样的结果,还存在着非常大的差距。特别是对于那些有安全性思量的企业客户来说,要在未来的3-5年内实现这样的本领,最大的寻衅是国有大模型能否经得起市场的验证,没有对比就没有伤害。因此,我们必要不断地学习和研究,积极提拔我们的大模型的本领。




免责声明:如果侵犯了您的权益,请联系站长,我们会及时删除侵权内容,谢谢合作!更多信息从访问主页:qidao123.com:ToB企服之家,中国第一个企服评测及商务社交产业平台。
页: [1]
查看完整版本: 深度解析 | PagerDuty Copilot - 运维领域大模型应用场景