乐于分享
好东西不私藏

Progress AI Observability 产品深度分析报告

Progress AI Observability 产品深度分析报告

——为创业者与AI团队的实战指南


一、产品定位与背景

Progress Software 是一家拥有 40 年历史的企业级软件老牌厂商,旗下 Telerik、Kendo UI、Sitefinity、MarkLogic、Fiddler 等产品在开发者圈中享有盛名。2026 年 8 月,Progress 正式上线 Progress AI Observability Platform(原 Telerik AI Observability),定位为面向生产级 AI Agent 与 LLM 应用的全链路可观测性平台,覆盖调试、成本控制、质量评估三大核心场景。

核心口号See where workflows break, what they cost, and whether outputs are good enough to ship.


二、产品解决的"AI 生产真问题"

Progress 在产品文档中精准指出了当前 AI 产品化的三大痛点:

执行路径不可见:Agent 不是简单的请求—响应。一次回答可能穿过 prompt、retrieval、tool call、retry、model response、自定义工作流。没有完整 trace,团队只能"猜"。

成本失控:LLM 账单随 prompt 长度、模型选择、retry 次数、tool loop、检索模式、评估运行量动态变化。看定价表等于瞎子摸象。

"看起来对"的失败:响应可能完整、流畅、语法正确,却包含幻觉、无依据、不安全或不相关的内容。

Progress 把这些问题作为产品设计的出发点。


三、四大核心功能模块

3.1 Workflow Tracing(工作流追踪)

• 捕获完整的 agent 运行路径:spans、model calls、tool calls、retrieval steps、latency、token usage、outputs

• 支持单 Agent、多 Agent 系统、tool-using agent、RAG pipeline、Copilot 等生产级场景

• 一次 trace 能告诉你"答案错了,是因为 retrieval 步骤返回了过期文档,agent 还用了"

3.2 Workflow Debugging(调试)

• 区分"成功响应"与"真实成功"

• 主动暴露:跳过的 tool、错误的检索源、loop、retry、失败的 span、延迟尖峰

• 客户案例:从 4 小时调试时间压缩到 20 分钟

3.3 Cost Analysis(成本分析)

• 估算成本、输入/输出 tokens、按 model、按 workflow、按 agent 拆分

• 哲学:LLM 成本由运行时行为决定,不是定价表决定的

• 实操价值:找到一个生产环境的 retry loop,就能省出一年的 Starter 订阅费

3.4 LLM Evaluations + Datasets & Experiments(评估与实验)

• LLM-as-a-judge 评分:质量、相关性、有依据性、安全性、任务完成度

• 支持实时评估历史回溯评估

• 用真实生产 trace 构造 evaluation dataset,对 prompt / model / workflow 改动做 A/B


四、技术架构与集成

4.1 SDK 支持(三大主流栈)

# .NET

dotnet add package Progress.Observability.Instrumentation

pip install progress-observability

npm install progress-observability

接入成本:安装 SDK + 几行代码即可,5 分钟可上线。

4.2 关键差异化:原生 .NET 支持

• 业界首个生产级原生 .NET SDK,对 Semantic Kernel 一级集成

• 与 Azure、Microsoft 生态深度契合

• 满足企业合规需求:审计日志、PII 脱敏、数据驻留(BYOS)、SSO、RBAC

4.3 性能设计

• 轻量级、异步上报,不影响 agent 执行与用户延迟


五、定价结构(2026 年最新)

| 套餐 | 月费 | Units | 保留期 | 核心能力 |

|------|------|-------|--------|----------|

| Free Forever | $0 | 10,000 | 7 天 | Trace Explorer、基础 prompt 记录、基础成本可见性、基础 LLM 评估、三大 SDK |

| Starter | $29/月 | 200,000 | 30 天 | 完整成本归因、实时+历史评估、Datasets & Experiments、异常告警 |

| Pro | $299/月 | 1,000,000 | 60 天 | 增加 SSO |

| Enterprise | $3,000+ 起 | 自定义 | 无限 | BYOS 数据驻留、审计日志、访问控制、SLAs |

• 超量:$8 / 10 万 units

⚠️ 注意:Progress 未在官网上明确定义"unit"计量单位,这是当前产品最大的透明度问题。第三方推测 1 unit ≈ 1 telemetry span,evaluation 消耗更多。


六、与竞品的横向对比

| 维度 | Progress AI Observability | Langfuse | LangSmith | LangWatch |

|------|--------------------------|----------|-----------|-----------|

| 开源 | ❌ | ✅ | ❌ | 部分 |

| 入门价 | $29 | $29 | $39/seat | EUR 29/seat |

| Pro 价 | $299 | $199 | - | - |

| .NET 原生 | ✅ 业界唯一 | ❌ | ❌ | � |

| 自托管 | ❌ | ✅ | ❌ | ❌ |

| 集成生态 | 中等 | 业界最大 | 与 LangChain 紧耦合 | 中等 |

| 企业合规 | 强(审计/数据驻留) | 弱 | 中 | 弱 |

| 公开客户案例 | ⚠️ 仅有匿名 Early Access | 多 | 多 | 多 |


七、给创业者的决策建议

7.1 ✅ 推荐使用的场景

技术栈基于 .NET / Azure / Semantic Kernel:这是 Progress 的"无人区",几乎无敌

ToB 企业客户对数据驻留、审计日志、SSO 有硬性要求

多 Agent / RAG 系统生产环境,需要 trace 级调试能力

预算紧张但想了解真实 LLM 成本——免费 tier 足够用于 cost audit

7.2 ❌ 暂不建议的场景

纯 Python / TypeScript 技术栈:Langfuse 更成熟、社区更大、插件更多

需要自托管:Progress 是纯 SaaS

预算介于 $29—$299 之间:中间有 10 倍定价悬崖,可能造成过度付费

需要大量公开客户背书:Progress 当前的性能数据来自匿名 Early Access 用户

7.3 💡 实操建议

第一周:用 Free Forever 上线,观察 unit 消耗与成本数据

第二周:跑一次完整评估 baseline,找到最贵的 retry loop

第三周:再决定是否升级到 Starter($29)或直接 Pro($299)

核心策略:把 Progress 当作"成本审计工具"来用,单次 ROI 决策


八、产品评分与展望

综合评分:7.5 / 10

优势

• ✅ 解决真问题,定位精准

• ✅ 唯一原生 .NET 支持,开辟蓝海

• ✅ 老牌厂商,财务健康,enterprise-ready

• ✅ 入门价位有竞争力,免费 tier 实用

短板

• ⚠️ "unit" 单位不透明,预算规划难

• ⚠️ 中端定价断层($29 → $299)

• ⚠️ 公开客户案例不足,性能数据匿名

• ⚠️ 生态相比 Langfuse 还很早期

未来展望

如果 Progress 能:

• 公开 unit 定义与定价计算器

• 补齐 $99—$199 中端档位

• 公布 3—5 个具名客户的 case study

• 增加开源 SDK 与社区生态

它极有可能在 18 个月内成为 .NET 阵营 AI 可观测性的事实标准,并在企业合规市场上对 Langfuse/LangSmith 形成实质性威胁。


九、最后一句话总结

Progress AI Observability 不是一个革命性产品,但它是一个聪明的、在正确时间切入正确细分市场的产品。
对于 .NET 技术栈的 AI 创业者和 ToB SaaS 团队,这是一个几乎不可替代的选择;对于纯 Python 团队,它是一个"可以但不必"的选择。

行动建议:立刻注册 Free Forever,用一周时间搞清楚你的 AI 产品到底烧了多少钱。这或许是 2026 年 ROI 最高的一小时。