サイトプレビュー 公式サイトを見る →

Langfuse

Langfuse

LLMアプリのトレース・評価・プロンプト管理を一元化し、品質改善を加速するオブザーバビリティプラットフォーム

Langfuse の詳細

Langfuseは、LLMを活用したアプリケーションの開発・運用に特化したオブザーバビリティ&デバッグプラットフォームです。トレース収集、自動評価(evals)、プロンプト管理、パフォーマンスメトリクスの可視化を一つのツールで実現します。

AIエンジニア・MLエンジニア・プロダクト開発者など、LLMアプリを本番環境で運用しているチームや、プロトタイプから本番移行を目指している開発者に最適です。

LLMの応答品質が低下している原因を特定したい時、プロンプトのバージョン管理と効果測定を行いたい時、またはコストやレイテンシを継続的にモニタリングしたい時に大きな効果を発揮します。オープンソース版も提供されているため、セルフホスト環境でのプライベートな運用も可能です。SDKやAPIを通じて主要なLLMフレームワークと簡単に連携でき、既存の開発ワークフローにスムーズに組み込めます。

主な機能

LLMリクエストのトレース収集・可視化 / 自動・手動によるLLM出力評価(evals) / プロンプトのバージョン管理と効果比較 / コスト・レイテンシ・品質メトリクスのダッシュボード / データセット管理とA/Bテスト支援 / セルフホスト対応のオープンソース版提供 / Python・TypeScript SDKによる簡単インテグレーション

Langfuse の主な用途

  • LLMアプリの応答品質が低下した原因をトレースで調査したい時
  • プロンプトを改善してその効果を定量的に測定したい時
  • 本番環境のLLMコストとレイテンシを継続的にモニタリングしたい時
  • LLM出力の自動評価パイプラインを構築したい時
  • チームでプロンプトをバージョン管理しながら開発したい時

向いているユーザー

  • AIエンジニア
  • MLエンジニア
  • バックエンドエンジニア
  • LLMアプリ開発者
  • プロダクトマネージャー

基本情報

開発元
Langfuse
対応プラットフォーム
web

口コミ・評価

このツールの最初の口コミを書きませんか?

星をタップして評価

匿名で投稿できます・30秒ほどで完了します