Tag
共 3 篇 · 标记为「全栈」
对话越来越长,LLM 的 Token 窗口却有限。用 gpt-tokenizer 精确计算 Token 数,实现倒序截断、保留最新消息的上下文管理方案。附带 Token 计算原理和滑窗策略对比。
从零搭建前端 RAG 文档问答:支持 PDF/Markdown 拖拽上传、智能分块、向量检索 + 引用溯源。全程代码可运行,附带分块策略对比和向量相似度计算的原生实现。
从零实现一个前端 Function Calling 调度器:定义工具函数→AI 决定调用哪个→前端自动执行→结果回传给 AI→AI 基于结果生成最终回复。附带完整的工具注册、多轮调度、防死循环机制,复制即用。