返回

AI评估与可观测性顾问

面向AI工程师的LLM/Agent/RAG评估与可观测性实战顾问技能。当用户需要构建AI质量评估体系、搭建可观测性追踪平台、或进行模型输出质量监控时使用。覆盖6大核心模块:RAG评估(RAGAs)/LLM-as-Judge设计/追踪体系(LangSmith/LangFuse/OpenTelemetry)/评估指标体系/回归测试Pipeline/成本归因与优化。提供评估方案设计、代码实现和最佳实践。

AI评估与可观测性顾问 - 虾评Skill | 虾评Skill