WALL-E's Blog

LLMMathPrimer

分类 - LLMMathPrimer
2026
大模型数学速成(19):DPO 与 RLHF 目标函数速览
2026-07-10
大模型数学速成(19):DPO 与 RLHF 目标函数速览
大模型数学速成(18):MoE——稀疏 FFN 与路由
2026-07-10
大模型数学速成(18):MoE——稀疏 FFN 与路由
大模型数学速成(17):Flash Attention——不物化注意力矩阵
2026-07-10
大模型数学速成(17):Flash Attention——不物化注意力矩阵
大模型数学速成(16):LoRA——低秩适配在算什么
2026-07-10
大模型数学速成(16):LoRA——低秩适配在算什么
大模型数学速成(15):量化——从 FP16 到 INT4 的尺度
2026-07-10
大模型数学速成(15):量化——从 FP16 到 INT4 的尺度
大模型数学速成(14):采样——Temperature、top-k 与 top-p
2026-07-10
大模型数学速成(14):采样——Temperature、top-k 与 top-p
大模型数学速成(13):因果掩码与解码循环
2026-07-10
大模型数学速成(13):因果掩码与解码循环
大模型数学速成(12):输出层、Logits 与交叉熵
2026-07-10
大模型数学速成(12):输出层、Logits 与交叉熵
大模型数学速成(11):KV Cache——推理加速的关键
2026-07-09
大模型数学速成(11):KV Cache——推理加速的关键
大模型数学速成(10):GQA——分组查询注意力
2026-07-08
大模型数学速成(10):GQA——分组查询注意力
12
avatar
WALL-E-2000
文章
169
标签
401
分类
15
Follow Me
公告
This is my Blog
最新文章
语言模型微调实战(09):部署、复盘与下一步
语言模型微调实战(09):部署、复盘与下一步2026-08-10
专注时段网站拦截器:一个 Manifest V3 Chrome 扩展的设计与实现
专注时段网站拦截器:一个 Manifest V3 Chrome 扩展的设计与实现2026-08-09
语言模型微调实战(08):提升结构化输出的泛化与可靠性
语言模型微调实战(08):提升结构化输出的泛化与可靠性2026-08-09
语言模型微调实战(07):评估与失败分析
语言模型微调实战(07):评估与失败分析2026-08-08
语言模型微调实战(06):看日志与选轮数
语言模型微调实战(06):看日志与选轮数2026-08-07
分类
  • AI20
  • Assembly7
  • Blog3
  • CppInPractice28
  • Docker1
  • LLMMathPrimer20
  • LLaMAFactorySFT10
  • Life7
标签
Hexo 背压 Token 位置编码 HashMap OCR 标准 基础语法 协程 训练配置 Embedding Temperature Xcode 微调 Clippy 栈 Prompt auto RAII 工具库 电影 现代构建 Vim Fine-tuning 类型推导 线程 递归 llama.cpp Flash Attention 路由 Tokio jthread 学习方法 因果掩码 GQA initramfs UTF-8 踩坑 定时任务 低秩
归档
  • 八月 2026 12
  • 七月 2026 86
  • 六月 2026 41
  • 一月 2026 1
  • 五月 2025 7
  • 六月 2023 1
  • 十一月 2022 2
  • 四月 2020 1
网站信息
文章数目 :
169
本站访客数 :
本站总浏览量 :
最后更新时间 :
© 2025 - 2026 By WALL-E-2000框架 Hexo 8.1.2|主题 Butterfly 5.5.5