# Text2SqlCache **Repository Path**: newPuppy/Text2SqlCache ## Basic Information - **Project Name**: Text2SqlCache - **Description**: 一个Text2SQL场景下的缓存复用Demo - **Primary Language**: Unknown - **License**: Not specified - **Default Branch**: master - **Homepage**: None - **GVP Project**: No ## Statistics - **Stars**: 0 - **Forks**: 0 - **Created**: 2026-04-23 - **Last Updated**: 2026-04-23 ## Categories & Tags **Categories**: Uncategorized **Tags**: None ## README # 快速使用指南 ## 如何使用 ### 1. 访问应用 在浏览器中打开:**http://localhost:3000** ### 2. 开始聊天 1. 在底部输入框输入问题,例如: - "你好" - "什么是人工智能?" - "如何学习 Python?" 2. 按回车键或点击发送按钮 3. 观察 AI 回复和缓存状态 ### 3. 查看缓存统计 左侧面板显示: - **TOTAL CACHES**: 缓存的问题总数 - **HIT PRECISION**: 缓存命中率 - **TOKENS SAVE**: 节省的 Token 数量 ### 4. 管理缓存 - **Refresh**: 刷新缓存列表 - **Clear**: 清空所有缓存 - 分页导航:浏览所有缓存记录 ## 测试缓存功能 ### 第一次提问(Cache Miss) ``` 问题:"什么是云计算?" ``` - 状态:Cache: Miss(橙色) - 会调用 Dashscope API - 答案会被缓存 ### 第二次提问相同问题(Cache Hit) ``` 问题:"什么是云计算?" ``` - 状态:Cache: Hit(绿色) - 直接返回缓存答案 - 响应速度极快(<0.1 秒) ## 模型选择 点击右上角下拉框可选择: - **Qwen-Turbo** - 快速响应 - **Qwen-Plus** - 平衡性能 - **Qwen-Max** - 最强能力 ## 缓存开关 - ✅ **Cache 已勾选**: 使用缓存(推荐) - ☐ **Cache 未勾选**: 直接调用 API ## 常见问题 ### Q: 为什么缓存命中率是 0%? A: 因为是新应用,还没有缓存数据。多问几个问题后就会有缓存了。 ### Q: 如何验证缓存是否工作? A: 问同一个问题两次,第二次应该显示 "Cache: Hit" 并且响应时间明显更快。 ### Q: 缓存存在哪里? A: 缓存数据存储在 `gptcache.db` SQLite 数据库文件中。 ### Q: 如何清空缓存? A: 点击左侧面板的绿色 "Clear" 按钮。 ## API 端点测试 你可以直接使用 curl 测试 API: ```bash # 获取统计信息 curl http://localhost:8000/api/stats # 获取缓存列表 curl http://localhost:8000/api/cache/list # 发送聊天消息 curl -X POST http://localhost:8000/api/chat ^ -H "Content-Type: application/json" ^ -d "{\"message\": \"你好\", \"model\": \"qwen-turbo\", \"use_cache\": true}" ``` ## 性能提示 1. **缓存阈值**: 默认相似度阈值为 0.8(80% 相似) - 调低会增加命中率但可能降低答案质量 - 调高会减少命中率但答案更准确 2. **Token 节省**: 每次缓存命中都能节省 API 调用费用 3. **响应速度**: 缓存命中的响应速度比 API 调用快 10-100 倍 ## 下一步 现在就可以开始使用应用了! 1. 打开浏览器访问 http://localhost:3000 2. 开始提问测试缓存功能 3. 观察缓存统计的变化 祝你使用愉快!🎉