Whole-Knowledge-Base Context Cache

洪建全基金會 客服機器人

整個知識庫直接放進模型上下文,不做向量檢索。沒有 chunking、沒有 embedding、 沒有 top-k — 每一次回答,模型都看得到全部資料。

這個 Demo 的規模

255官網文章與活動頁
221.5Ktokens 常駐上下文
0向量資料庫
~2.5s平均回應時間

試試這些問題

嵌入到任何網站

<script src="https://quickbot.vurbo.chat/widget.js"
        data-api="https://quickbot.vurbo.chat"
        data-title="洪建全基金會 客服"></script>

Gemini 3.5 Flash Lite · Vertex AI explicit context caching · Cloud Run (asia-east1)
內部展示用途,回答內容以基金會官網公告為準。

試試看 →