Langfuse
开源平台,用于追踪、评估和改进AI智能体。利用生产数据理解行为,协作修复,以更低的成本和延迟交付更高质量。
访问 langfuse/langfuse项目简介
Langfuse是一个开源的智能体评估与可观测性平台。它将追踪、监控、数据集、实验和评估连接成一个持续循环,使团队能够从原型到生产规模追踪每一次LLM调用、管理提示词、进行评估和实验。
核心功能
- 分层追踪捕获每一次LLM调用、工具调用和检索步骤,可按用户、会话、成本、延迟或自定义元数据过滤。支持LLM-as-a-judge、启发式函数或人工审查的评估,可在生产数据或实验期间运行。提示词管理将提示词与代码分离,支持一键部署和回滚。Playground可在真实生产输入上测试提示词并并排比较模型。实验功能可定义测试用例、运行实验并并排比较结果。成本与延迟监控提供仪表板和自动警报。
适用场景
- 聊天智能体:为聊天支持和助手体验提供会话级追踪、评估和成本可见性。编码智能体。工作流自动化。
快速开始
- 从“开始追踪”指南入手,使用OpenAI、LangChain或SDK接入您的第一条追踪。
部署与要求
- 支持通过Docker Compose、Kubernetes(Helm)以及适用于AWS、GCP和Azure的Terraform进行自托管。
采用前须知
- 许可证:Other。在使用、修改或分发项目前,请确认其具体条款。