Michael.Meng
JournalPortfolioAbout Let's Talk

Tag

#性能优化

共 3 篇 · 标记为「性能优化」

AI 解读Multi-Head Attention 从数学到代码:TypeScript 并行多头实现完全指南
2026年7月23日◷ 8 分钟阅读

Multi-Head Attention 从数学到代码:TypeScript 并行多头实现完全指南

一个头只学一种关系?太慢。本文将多头注意力的并行分头、独立投影、Concat 全流程用 TypeScript 实现,并对比单头与多头的注意力模式差异。

阅读全文 →
AI 探索技术手记《Token 上下文截断:用 GPT-Tokenizer 精确控制 AI 对话长度》
2026年7月23日◷ 5 分钟阅读

《Token 上下文截断:用 GPT-Tokenizer 精确控制 AI 对话长度》

对话越来越长,LLM 的 Token 窗口却有限。用 gpt-tokenizer 精确计算 Token 数,实现倒序截断、保留最新消息的上下文管理方案。附带 Token 计算原理和滑窗策略对比。

阅读全文 →
AI 探索技术手记《前端本地 AI 实战:用 Transformers.js 在浏览器里跑 LLM》
2026年7月23日◷ 5 分钟阅读

《前端本地 AI 实战:用 Transformers.js 在浏览器里跑 LLM》

不依赖后端,在浏览器里直接运行 AI 模型。从模型选型、量化加载、IndexedDB 缓存到 WebWorker 隔离,一文打通前端本地 AI 的完整工程链路。

阅读全文 →
Michael.Meng

michaelnews@126.com
用 AI 记录,用文字沉淀

GHXRSSB
© 2026 Michael Meng · 保留所有权利 · Powered by FastAPI + Nuxt