Journal
博客
从实验到生产,从代码到洞察——记录 AI 在实际业务中落地的思考与经验。
AI 探索
AI 探索技术手记
FFmpeg WASM 浏览器端视频合成:从图片序列到 MP4 的前端实现
利用 @ffmpeg/ffmpeg 的 WebAssembly 版本,在浏览器中直接将图片序列合成为 MP4 视频。覆盖 FFmpeg WASM 初始化、图片写入虚拟文件系统、H.264 编码参数控制、进度回调、前端 vs 后端方案对比,以及
阅读全文 →AI 探索技术手记
AIGC任务队列与WebSocket实时状态更新系统
构建 AIGC 前端任务队列系统:涵盖任务状态机(pending/running/progress/completed/failed/canceled)、WebSocket 实时进度推送、并发控制、localStorage 持久化、失败重试与取消。支持图片生成、视频生成
阅读全文 →AI 探索技术手记
AI模型参数控制面板:多模型通用的前端参数系统设计
构建通用的 AI 模型参数控制面板:以 TypeScript 配置表驱动,动态渲染 LLM、文生图、文生视频三类模型的差异化参数。涵盖 temperature、TopP、采样步数、CFG、帧率,以及参数联动、互斥校验、非法输入拦截和 localStorag
阅读全文 →AI 探索技术手记
《Token 上下文截断:用 GPT-Tokenizer 精确控制 AI 对话长度》
对话越来越长,LLM 的 Token 窗口却有限。用 gpt-tokenizer 精确计算 Token 数,实现倒序截断、保留最新消息的上下文管理方案。附带 Token 计算原理和滑窗策略对比。
阅读全文 →AI 探索技术手记
《前端本地 AI 实战:用 Transformers.js 在浏览器里跑 LLM》
不依赖后端,在浏览器里直接运行 AI 模型。从模型选型、量化加载、IndexedDB 缓存到 WebWorker 隔离,一文打通前端本地 AI 的完整工程链路。
阅读全文 →AI 探索算法实践
《前端 RAG 文档问答系统:从文档上传到引用溯源的完整实现》
从零搭建前端 RAG 文档问答:支持 PDF/Markdown 拖拽上传、智能分块、向量检索 + 引用溯源。全程代码可运行,附带分块策略对比和向量相似度计算的原生实现。
阅读全文 →