——为创业者与AI团队的实战指南
一、产品定位与背景
Progress Software 是一家拥有 40 年历史的企业级软件老牌厂商,旗下 Telerik、Kendo UI、Sitefinity、MarkLogic、Fiddler 等产品在开发者圈中享有盛名。2026 年 8 月,Progress 正式上线 Progress AI Observability Platform(原 Telerik AI Observability),定位为面向生产级 AI Agent 与 LLM 应用的全链路可观测性平台,覆盖调试、成本控制、质量评估三大核心场景。
核心口号:See where workflows break, what they cost, and whether outputs are good enough to ship.
二、产品解决的"AI 生产真问题"
Progress 在产品文档中精准指出了当前 AI 产品化的三大痛点:
• 执行路径不可见:Agent 不是简单的请求—响应。一次回答可能穿过 prompt、retrieval、tool call、retry、model response、自定义工作流。没有完整 trace,团队只能"猜"。
• 成本失控:LLM 账单随 prompt 长度、模型选择、retry 次数、tool loop、检索模式、评估运行量动态变化。看定价表等于瞎子摸象。
• "看起来对"的失败:响应可能完整、流畅、语法正确,却包含幻觉、无依据、不安全或不相关的内容。
Progress 把这些问题作为产品设计的出发点。
三、四大核心功能模块
3.1 Workflow Tracing(工作流追踪)
• 捕获完整的 agent 运行路径:spans、model calls、tool calls、retrieval steps、latency、token usage、outputs
• 支持单 Agent、多 Agent 系统、tool-using agent、RAG pipeline、Copilot 等生产级场景
• 一次 trace 能告诉你"答案错了,是因为 retrieval 步骤返回了过期文档,agent 还用了"
3.2 Workflow Debugging(调试)
• 区分"成功响应"与"真实成功"
• 主动暴露:跳过的 tool、错误的检索源、loop、retry、失败的 span、延迟尖峰
• 客户案例:从 4 小时调试时间压缩到 20 分钟
3.3 Cost Analysis(成本分析)
• 估算成本、输入/输出 tokens、按 model、按 workflow、按 agent 拆分
• 哲学:LLM 成本由运行时行为决定,不是定价表决定的
• 实操价值:找到一个生产环境的 retry loop,就能省出一年的 Starter 订阅费
3.4 LLM Evaluations + Datasets & Experiments(评估与实验)
• LLM-as-a-judge 评分:质量、相关性、有依据性、安全性、任务完成度
• 支持实时评估与历史回溯评估
• 用真实生产 trace 构造 evaluation dataset,对 prompt / model / workflow 改动做 A/B
四、技术架构与集成
4.1 SDK 支持(三大主流栈)
# .NET
dotnet add package Progress.Observability.Instrumentation
pip install progress-observability
npm install progress-observability接入成本:安装 SDK + 几行代码即可,5 分钟可上线。
4.2 关键差异化:原生 .NET 支持
• 业界首个生产级原生 .NET SDK,对 Semantic Kernel 一级集成
• 与 Azure、Microsoft 生态深度契合
• 满足企业合规需求:审计日志、PII 脱敏、数据驻留(BYOS)、SSO、RBAC
4.3 性能设计
• 轻量级、异步上报,不影响 agent 执行与用户延迟
五、定价结构(2026 年最新)
| 套餐 | 月费 | Units | 保留期 | 核心能力 |
|------|------|-------|--------|----------|
| Free Forever | $0 | 10,000 | 7 天 | Trace Explorer、基础 prompt 记录、基础成本可见性、基础 LLM 评估、三大 SDK |
| Starter | $29/月 | 200,000 | 30 天 | 完整成本归因、实时+历史评估、Datasets & Experiments、异常告警 |
| Pro | $299/月 | 1,000,000 | 60 天 | 增加 SSO |
| Enterprise | $3,000+ 起 | 自定义 | 无限 | BYOS 数据驻留、审计日志、访问控制、SLAs |
• 超量:$8 / 10 万 units
• ⚠️ 注意:Progress 未在官网上明确定义"unit"计量单位,这是当前产品最大的透明度问题。第三方推测 1 unit ≈ 1 telemetry span,evaluation 消耗更多。
六、与竞品的横向对比
| 维度 | Progress AI Observability | Langfuse | LangSmith | LangWatch |
|------|--------------------------|----------|-----------|-----------|
| 开源 | ❌ | ✅ | ❌ | 部分 |
| 入门价 | $29 | $29 | $39/seat | EUR 29/seat |
| Pro 价 | $299 | $199 | - | - |
| .NET 原生 | ✅ 业界唯一 | ❌ | ❌ | � |
| 自托管 | ❌ | ✅ | ❌ | ❌ |
| 集成生态 | 中等 | 业界最大 | 与 LangChain 紧耦合 | 中等 |
| 企业合规 | 强(审计/数据驻留) | 弱 | 中 | 弱 |
| 公开客户案例 | ⚠️ 仅有匿名 Early Access | 多 | 多 | 多 |
七、给创业者的决策建议
7.1 ✅ 推荐使用的场景
• 技术栈基于 .NET / Azure / Semantic Kernel:这是 Progress 的"无人区",几乎无敌
• ToB 企业客户对数据驻留、审计日志、SSO 有硬性要求
• 多 Agent / RAG 系统生产环境,需要 trace 级调试能力
• 预算紧张但想了解真实 LLM 成本——免费 tier 足够用于 cost audit
7.2 ❌ 暂不建议的场景
• 纯 Python / TypeScript 技术栈:Langfuse 更成熟、社区更大、插件更多
• 需要自托管:Progress 是纯 SaaS
• 预算介于 $29—$299 之间:中间有 10 倍定价悬崖,可能造成过度付费
• 需要大量公开客户背书:Progress 当前的性能数据来自匿名 Early Access 用户
7.3 💡 实操建议
• 第一周:用 Free Forever 上线,观察 unit 消耗与成本数据
• 第二周:跑一次完整评估 baseline,找到最贵的 retry loop
• 第三周:再决定是否升级到 Starter($29)或直接 Pro($299)
• 核心策略:把 Progress 当作"成本审计工具"来用,单次 ROI 决策
八、产品评分与展望
综合评分:7.5 / 10
优势
• ✅ 解决真问题,定位精准
• ✅ 唯一原生 .NET 支持,开辟蓝海
• ✅ 老牌厂商,财务健康,enterprise-ready
• ✅ 入门价位有竞争力,免费 tier 实用
短板
• ⚠️ "unit" 单位不透明,预算规划难
• ⚠️ 中端定价断层($29 → $299)
• ⚠️ 公开客户案例不足,性能数据匿名
• ⚠️ 生态相比 Langfuse 还很早期
未来展望
如果 Progress 能:
• 公开 unit 定义与定价计算器
• 补齐 $99—$199 中端档位
• 公布 3—5 个具名客户的 case study
• 增加开源 SDK 与社区生态
它极有可能在 18 个月内成为 .NET 阵营 AI 可观测性的事实标准,并在企业合规市场上对 Langfuse/LangSmith 形成实质性威胁。
九、最后一句话总结
Progress AI Observability 不是一个革命性产品,但它是一个聪明的、在正确时间切入正确细分市场的产品。
对于 .NET 技术栈的 AI 创业者和 ToB SaaS 团队,这是一个几乎不可替代的选择;对于纯 Python 团队,它是一个"可以但不必"的选择。
行动建议:立刻注册 Free Forever,用一周时间搞清楚你的 AI 产品到底烧了多少钱。这或许是 2026 年 ROI 最高的一小时。
夜雨聆风