<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>RAGAS on PlumePHP</title><link>https://plumephp.com/tags/ragas/</link><description>Recent content in RAGAS on PlumePHP</description><generator>Hugo</generator><language>zh-CN</language><lastBuildDate>Sun, 27 Sep 2026 10:00:00 +0800</lastBuildDate><atom:link href="https://plumephp.com/tags/ragas/index.xml" rel="self" type="application/rss+xml"/><item><title>RAG 架构全景：从检索增强生成到 Agentic RAG 的生产实践</title><link>https://plumephp.com/ai-llm-rag-patterns/</link><pubDate>Sun, 27 Sep 2026 10:00:00 +0800</pubDate><guid>https://plumephp.com/ai-llm-rag-patterns/</guid><description>RAG 架构全景：索引策略、查询改写、混合检索、Reranker、RAGAS 评估与 Agentic RAG 生产实践。</description></item><item><title>AI 模型测试实战：从 LLM 输出验证到 RAG 质量评估的全链路质量工程</title><link>https://plumephp.com/ai-model-testing/</link><pubDate>Sat, 26 Sep 2026 00:00:00 +0800</pubDate><guid>https://plumephp.com/ai-model-testing/</guid><description>&lt;p&gt;传统的测试方法论建立在&lt;strong&gt;确定性&lt;/strong&gt;之上：同样的输入必然得到同样的输出，断言 &lt;code&gt;assert x == y&lt;/code&gt; 是质量的黄金标准。但以 LLM 为代表的生成式 AI 模型打破了这一前提——同样的 prompt 每次调用可能返回不同的、且没有唯一正确答案的文本。&lt;code&gt;assert response == &amp;quot;Hello&amp;quot;&lt;/code&gt; 在 AI 测试中不再有意义，取而代之的是&amp;quot;这段回答是否语义正确？&amp;ldquo;&amp;ldquo;它是否忠实于给定的知识库？&amp;ldquo;&amp;ldquo;它是否包含了偏见？&amp;quot;。本指南系统覆盖 LLM 输出验证、RAG 质量评估、Prompt 回归测试、模型性能与对抗性测试，以及 MLOps CI/CD 中的模型质量门禁建设。&lt;/p&gt;</description></item><item><title>模型评估与 LLMOps：从离线评测到生产监控的闭环体系</title><link>https://plumephp.com/llm-evaluation-llmops/</link><pubDate>Sat, 26 Sep 2026 00:00:00 +0800</pubDate><guid>https://plumephp.com/llm-evaluation-llmops/</guid><description>&lt;p&gt;LLM 应用上线后的最大风险不是&amp;quot;跑不起来&amp;quot;，而是&amp;quot;悄悄变差&amp;quot;——模型升级、Prompt 改动、知识库更新都可能引入质量回归，而概率性输出让这种退化难以用传统测试发现。LLMOps 的核心是建立&lt;strong&gt;评估（Evaluation）与监控（Monitoring）的闭环&lt;/strong&gt;：离线用评测集守住质量基线，在线用指标捕获漂移。本指南系统覆盖评测集设计、指标选型、LLM-as-a-Judge 可靠性、回归门禁、生产监控与成本治理的完整实践。&lt;/p&gt;</description></item></channel></rss>