
数据分析
Langfuse
面向 LLM 应用的追踪、评估、提示词管理和成本可观测平台。
资源介绍
Langfuse 面向构建 LLM 和 Agent 应用的工程团队,提供调用追踪、提示词版本、评估、延迟和成本观测能力。它可以把一次用户请求拆成模型调用、工具调用和检索步骤,帮助团队定位回答质量下降、上下文过长、工具失败和费用上升的原因。对于正在从演示走向生产的 AI 产品,先建立可回放的 trace 和少量人工评估集,通常比单纯增加模型参数更有诊断价值。
接入时要先决定哪些输入、输出和元数据可以保存,给敏感字段做脱敏或采样。提示词版本、模型版本和评估数据要绑定到同一发布记录,避免复盘时无法重现。评估分数不能当成绝对质量证明,仍需要真实用户反馈和人工抽样。自托管方案还要考虑数据存储、权限、保留期和升级,云端方案则要核对数据处理边界和团队访问。
适合什么人
需要调试、评估、版本化和控制 LLM/Agent 应用质量与成本的工程团队。
真实使用场景
价格说明
官网提供云端和自托管相关能力,事件量、保留期、团队权限和高级评估功能以当前官方方案为准。
核心特点
限制与注意事项
常见问题
Langfuse 解决的是哪类问题?
它主要帮助团队看清 LLM 应用的调用链、质量、延迟和成本,不能替代模型本身或业务监控。
哪些数据不应直接记录?
密码、密钥、个人敏感信息和未脱敏业务内容都应先过滤、脱敏或采样,再决定是否进入 trace。
如何建立可用的评估流程?
从代表性任务集开始,固定评分标准和模型/提示词版本,结合自动指标、人工抽样和线上反馈复盘。
来源与核验
本页关于 Langfuse 的公开产品信息参考以下来源,未实测或未确认的事项另有说明,可以打开原页面核对。最近一次核验时间是 2026-08-14。官网改版后信息可能变化,以官网当前内容为准。
- langfuse.com官网Langfuse 官方产品页










