Michael.Meng
JournalPortfolioAbout Let's Talk

Tag

#全栈

共 3 篇 · 标记为「全栈」

AI 探索技术手记《Token 上下文截断:用 GPT-Tokenizer 精确控制 AI 对话长度》
2026年7月23日◷ 5 分钟阅读

《Token 上下文截断:用 GPT-Tokenizer 精确控制 AI 对话长度》

对话越来越长,LLM 的 Token 窗口却有限。用 gpt-tokenizer 精确计算 Token 数,实现倒序截断、保留最新消息的上下文管理方案。附带 Token 计算原理和滑窗策略对比。

阅读全文 →
AI 探索算法实践《前端 RAG 文档问答系统:从文档上传到引用溯源的完整实现》
2026年7月23日◷ 5 分钟阅读

《前端 RAG 文档问答系统:从文档上传到引用溯源的完整实现》

从零搭建前端 RAG 文档问答:支持 PDF/Markdown 拖拽上传、智能分块、向量检索 + 引用溯源。全程代码可运行,附带分块策略对比和向量相似度计算的原生实现。

阅读全文 →
AI 探索《前端 Function Calling 调度器:让 AI 自己调用你的函数》
2024年7月23日◷ 6 分钟阅读

《前端 Function Calling 调度器:让 AI 自己调用你的函数》

从零实现一个前端 Function Calling 调度器:定义工具函数→AI 决定调用哪个→前端自动执行→结果回传给 AI→AI 基于结果生成最终回复。附带完整的工具注册、多轮调度、防死循环机制,复制即用。

阅读全文 →
Michael.Meng

michaelnews@126.com
用 AI 记录,用文字沉淀

GHXRSSB
© 2026 Michael Meng · 保留所有权利 · Powered by FastAPI + Nuxt