<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>KV Cache on PlumePHP</title><link>https://plumephp.com/tags/kv-cache/</link><description>Recent content in KV Cache on PlumePHP</description><generator>Hugo</generator><language>zh-CN</language><lastBuildDate>Sun, 27 Sep 2026 09:00:00 +0800</lastBuildDate><atom:link href="https://plumephp.com/tags/kv-cache/index.xml" rel="self" type="application/rss+xml"/><item><title>多模态推理实战：从图像 Token 化到视觉语言模型联合推理</title><link>https://plumephp.com/ai-multimodal-inference/</link><pubDate>Sun, 27 Sep 2026 09:00:00 +0800</pubDate><guid>https://plumephp.com/ai-multimodal-inference/</guid><description>&lt;blockquote&gt;
&lt;p&gt;大语言模型的文本能力已经被充分挖掘，而让模型&amp;quot;看懂图&amp;quot;的多模态推理，正在成为企业级应用的新战场：文档解析、商品识别、自动驾驶、智能客服。本文从图像如何变成 Token 讲起，深入视觉语言模型（VLM）的联合推理机制、多模态 KV Cache 显存管理，再到生产级多模态推理服务部署。&lt;/p&gt;</description></item></channel></rss>