应用(Applications) Ragas 实战。展示如何在各种应用与场景中使用 Ragas,解决你在构建过程中可能遇到的问题。 Prompt 评测(Prompt Evaluation) 迭代并改进 Prompt 系统性 Prompt 优化 指标(Metrics) 用 tracing 调试基于 LLM 的指标 评测多轮对话 估算评测成本 使用 Vertex AI 模型进行评测 测试集生成(Testset Generation) 单跳查询测试集(Single-hop Query Testset) 基准测试(Benchmarking) 针对你的用例评测新 LLM RAG 评测(RAG Evaluation) 评测并改进 RAG 系统 Agent 评测(Agent Evaluation) 评测 Text-to-SQL Agent