本期更新主要为观测云更新和 DataKit 更新。详情见官网文档:https://docs.guance.com/release-notes/ 01 观测云更新 Obsy AI AI 积分明细 & 消耗分析:支持查看 Obsy AI 积分变动明细。通过趋势图和热力图拆分 Agent、Copilot 等消耗来源,帮助团队更直观地掌握 AI 积分使用情况和成本变化。 Agent Teams Agent 角色控制优化:新增 Agent 默认空间角色,用作 Agent 在空间内的默认权限配置,帮助管理员更合理地控制 Agent 的权限边界,减少权限过宽或误配风险。 Agent 智能等级选择:支持在我的任务和自动化任务中选择 Auto、Fast、Standard、Pro 等智能等级,方便用户根据任务复杂度在响应速度、智能等级和积分消耗之间灵活取舍。 Skill 市场:提供官方技能市场入口,让用户可以更方便地发现、安装和管理官方技能,降低 Agent 能力扩展和维护成本,并提升 Agent 在不同任务场景下的可用性。 Agent 监测 Agent 实例名称支持输入中文,便于按业务、团队或场景进行命名和管理。 插件更新命令调整为独立入口,不再放在创建实例流程中,创建流程更简洁。 Trace 详情页调用分析新增模型调用次数、工具调用次数、Skill 调用次数统计,便于快速了解本次 Trace 的调用构成。 统一目录 内置视图详情页新增时间控件能力,支持按时间范围查看数据。 全景拓扑新增实体管理能力,支持修改或删除实体。 故障中心 故障详情页新增“故障指标”Tab,支持查看本次故障周期指标和故障统计指标。 本次故障周期指标展示当前周期的触发、接手、恢复、关闭时间线,以及本次响应耗时(MTTA)、本次恢复耗时(MTTR)、本次持续时间三项核心指标。 故障统计指标从首次触发以来累计计算,展示首次触发时间、最近触发时间、总重开次数、平均 MTTA、平均 MTTR。 故障发生重开后,本次周期指标仅展示最新周期数据,统计指标持续累计更新。 SLO SLO 新增分组维度功能,支持在同一个 SLO 下按业务维度分别追踪不同 project、service、env 的达标率,无需为每条业务线单独创建 SLO。 新建或编辑 SLO 时,SLI 区块下方新增“分组维度”配置区。选择 SLI 监控器后,系统会自动读取该监控器最近 7 天数据中实际存在的维度值。 SLO 详情侧边页标题下方新增维度筛选行,支持切换查看不同维度值组合的达标率。 场景仪表板配置 SLO 图表时,查询区新增“筛选维度”行,选择具体维度值后,图表实时展示对应达标率。 注意:各维度组合为独立计算线,不支持跨维度聚合。如需查看 project 级别的达标率,需单独创建按 project 分组的 SLO。未配置分组维度的旧 SLO 行为不变,完全向下兼容。 通知对象 Webhook 通知对象新增自定义 Body 模板配置项。开启后,用户可自由编写请求体内容,并引用告警上下文变量,满足将告警数据推送至 Kafka 等下游系统的自定义格式需求。 未配置自定义 Body 模板时,Webhook 保持原有固定格式,向下兼容。 仪表板 简单查询模式新增同聚合指标多选能力,支持在同一查询行中同时选择多个指标,与 DQL 模式下单语句多指标查询能力对齐。 管理 Login IP 白名单与 OpenAPI 访问 IP 白名单的 Role IP 白名单规则行新增备注输入框,支持为每条角色规则添加自定义说明。 OpenAPI 新增成员个人 API Key 权限开关接口:POST /api/v1/workspace/member/personal_api_key/enable/modify,支持通过 API Key 批量开启或关闭成员的个人 API Key 使用权限。 调用方需具备 workspace.personalAPIKeyManage 权限,仅 Owner 及工作空间管理员身份的 API Key 可调用。 数据转发 转发规则列表页新增快捷筛选项,支持基于数据类型、存储格式、存储路径、存档类型快速筛选定位规则。 对象存储规则配置页新增“数据等待时间”配置。数据会先写入本地临时文件,当文件大小达到 256 MB 或等待时间达到设定值时,系统会自动压缩并上传。 生成指标 生成指标频率配置新增 30 分钟、1 小时、6 小时、12 小时、24 小时等预设选项。 支持在 24 小时内自定义输入生成频率,满足更灵活的指标计算周期配置需求。 02 DataKit 更新 新加功能 Oracle 采集器新增 ASM 磁盘组指标采集 Oracle 采集器新增数据库打开模式、资源上限及数据文件限额指标 Flameshot 新增 Go 语言 pprof 采集支持 Flameshot 新增主动 Heap Dump 与 hprof 上传至 OSS/S3 问题修复 修复 gpu_smi 掉卡告警逻辑死循环风险 修复聚合链路 tail sampling 未按 sinker header 分组的问题 功能优化 Redis 新增 role_status 指标字段,支持主从角色变化检测 新增全局 measurement_version 配置,支持安装/升级时统一指定指标集版本,覆盖 MySQL、Oracle、PostgreSQL、SQLServer、Redis、JVM 等采集器 新增 /v1/health 端点与 CRI 运行时故障自恢复,优化 K8s liveness 检测 什么是观测云? 观测云是一款 AI 时代的全域数据观测平台,全面覆盖 App、Web、后端、中间件、基础设施与云平台的全链路监控,集成 650+ 主流技术栈与云服务。连接开发、运维与业务团队,打破数据孤岛,以海量数据与统一为核心,让企业实现数据的统一存储、统一查询与统一展示,最终让一切数据都能被理解与利用,让云上数据成为企业可执行的洞察。已服务1000+ 家企业,覆盖 AI、金融、零售、制造等行业。
