Tags
- 数据结构与算法 29
- d2l 11
- pytorch 11
- 深度学习 11
- c 7
- vllm 7
- llm-推理 7
- csapp 5
- 神经网络 5
- 汇编 3
- 量化绿皮书 3
- 计算机视觉 3
- kv-cache 3
- 面经 2
- cnn 2
- gpu 2
- nlp 2
- fp8 2
- life 1
- 多线程 1
- 设计模式 1
- 量化开发 1
- 并发 1
- 性能优化 1
- ddp 1
- 分布式训练 1
- 迁移学习 1
- 微调 1
- 目标检测 1
- 语义分割 1
- rnn 1
- gru 1
- lstm 1
- 序列模型 1
- seq2seq 1
- 机器翻译 1
- 编码器-解码器 1
- 注意力机制 1
- self-attention 1
- transformer 1
- gqa 1
- tensor-parallel 1
- enginecore 1
- gpumodelrunner 1
- 服务架构 1
- pagedattention 1
- 显存管理 1
- automatic-prefix-caching 1
- 哈希 1
- scheduler 1
- continuous-batching 1
- chunked-prefill 1
- 量化 1
- awq 1
- gptq 1
- speculative-decoding 1
- flashattention 1
- attention 1
数据结构与算法
- » Leetcode记录:全部例题直观解释与代码执行步骤
- » Leetcode记录:缓存
- » Leetcode记录:Floyd算法
- » Leetcode记录:Bellman-ford算法
- » Leetcode记录:拓扑排序
- » Leetcode记录:最小生成树
- » Leetcode记录:单源最短路径问题:Dijkstra算法
- » Leetcode记录:图论dfs和bfs
- » Leetcode记录:并查集
- » Leetcode记录:序列、字符串DP问题
- » Leetcode记录:0-1背包问题
- » Leetcode记录:DP基础问题、打家劫舍、股票问题
- » Leetcode记录:贪心算法
- » Leetcode记录:回溯
- » Leetcode记录:单调栈
- » Leetcode记录:二叉搜索树
- » Leetcode记录:二叉树例题
- » Leetcode记录:二叉树遍历
- » Leetcode记录:排序算法
- » Leetcode记录:单调队列
- » Leetcode记录:栈和队列
- » Leetcode记录:KMP算法
- » Leetcode记录:字符串例题
- » Leetcode记录:哈希表例题
- » Leetcode记录:哈希表
- » Leetcode记录:链表
- » Leetcode记录:滑动窗口和前缀和
- » Leetcode记录:模拟过程
- » Leetcode记录:二分查找和双指针法
d2l
- » D2L 注意力机制:从 QKV、多头自注意力到 Transformer
- » D2L Seq2Seq 机器翻译:从双语数据、编码器—解码器到掩码损失与自回归生成
- » D2L 循环神经网络:从序列数据与 BPTT 到 GRU、LSTM、深层和双向建模
- » 计算机视觉任务全景:从数据增强、目标检测到语义分割与风格迁移
- » D2L 微调学习总结:从迁移学习到热狗识别
- » D2L 计算性能学习总结:从硬件、异步执行到多机 DDP
- » CNN 从卷积到 DenseNet:经典架构为何这样演进
- » PyTorch 深度学习计算与工程实践:从 nn.Module 到可复现建模流程
- » 多层感知机、泛化与稳定训练:从非线性到残差思想
- » 从线性回归到 Softmax 分类:损失、概率与决策边界
- » PyTorch 与神经网络训练基础:从 Tensor Shape 到完整训练循环
pytorch
- » D2L 注意力机制:从 QKV、多头自注意力到 Transformer
- » D2L Seq2Seq 机器翻译:从双语数据、编码器—解码器到掩码损失与自回归生成
- » D2L 循环神经网络:从序列数据与 BPTT 到 GRU、LSTM、深层和双向建模
- » 计算机视觉任务全景:从数据增强、目标检测到语义分割与风格迁移
- » D2L 微调学习总结:从迁移学习到热狗识别
- » D2L 计算性能学习总结:从硬件、异步执行到多机 DDP
- » CNN 从卷积到 DenseNet:经典架构为何这样演进
- » PyTorch 深度学习计算与工程实践:从 nn.Module 到可复现建模流程
- » 多层感知机、泛化与稳定训练:从非线性到残差思想
- » 从线性回归到 Softmax 分类:损失、概率与决策边界
- » PyTorch 与神经网络训练基础:从 Tensor Shape 到完整训练循环
深度学习
- » D2L 注意力机制:从 QKV、多头自注意力到 Transformer
- » D2L Seq2Seq 机器翻译:从双语数据、编码器—解码器到掩码损失与自回归生成
- » D2L 循环神经网络:从序列数据与 BPTT 到 GRU、LSTM、深层和双向建模
- » 计算机视觉任务全景:从数据增强、目标检测到语义分割与风格迁移
- » D2L 微调学习总结:从迁移学习到热狗识别
- » D2L 计算性能学习总结:从硬件、异步执行到多机 DDP
- » CNN 从卷积到 DenseNet:经典架构为何这样演进
- » PyTorch 深度学习计算与工程实践:从 nn.Module 到可复现建模流程
- » 多层感知机、泛化与稳定训练:从非线性到残差思想
- » 从线性回归到 Softmax 分类:损失、概率与决策边界
- » PyTorch 与神经网络训练基础:从 Tensor Shape 到完整训练循环
c
- » 量化开发面经:从原始代码逐版优化 SMA 行情处理
- » C++记录:std::string
- » C++20相关
- » 其他面经
- » C++补充
- » C++11\14特性
- » Leetcode记录:Effective C++ and Modern C++ 笔记记录
vllm
- » FlashAttention:从 IO-aware tiling 到 Hopper 异步流水
- » vLLM 量化与推测解码:怎样减少容量、带宽与串行轮次
- » vLLM Scheduler:Continuous Batching 与 Chunked Prefill
- » vLLM Automatic Prefix Caching:从 hash chain 到物理块复用
- » vLLM PagedAttention:从显存碎片到 slot mapping
- » vLLM V1 架构:一条请求怎样穿过推理服务
- » vLLM KV Cache:从历史重算到容量公式
llm-推理
- » FlashAttention:从 IO-aware tiling 到 Hopper 异步流水
- » vLLM 量化与推测解码:怎样减少容量、带宽与串行轮次
- » vLLM Scheduler:Continuous Batching 与 Chunked Prefill
- » vLLM Automatic Prefix Caching:从 hash chain 到物理块复用
- » vLLM PagedAttention:从显存碎片到 slot mapping
- » vLLM V1 架构:一条请求怎样穿过推理服务
- » vLLM KV Cache:从历史重算到容量公式
csapp
- » CSAPP-2-3:程序的机器级运行过程
- » CSAPP-2-2:程序的机器级运行控制
- » CSAPP-2-1:程序的机器级表示
- » CSAPP-1:家庭作业以及Data Lab要点
- » CSAPP-1:信息的表示和处理
神经网络
- » CNN 从卷积到 DenseNet:经典架构为何这样演进
- » PyTorch 深度学习计算与工程实践:从 nn.Module 到可复现建模流程
- » 多层感知机、泛化与稳定训练:从非线性到残差思想
- » 从线性回归到 Softmax 分类:损失、概率与决策边界
- » PyTorch 与神经网络训练基础:从 Tensor Shape 到完整训练循环
汇编
Top ⇈量化绿皮书
Top ⇈计算机视觉
Top ⇈kv-cache
- » vLLM Automatic Prefix Caching:从 hash chain 到物理块复用
- » vLLM PagedAttention:从显存碎片到 slot mapping
- » vLLM KV Cache:从历史重算到容量公式
面经
Top ⇈cnn
Top ⇈gpu
Top ⇈nlp
Top ⇈fp8
Top ⇈life
Top ⇈多线程
- » C++多线程
设计模式
- » 设计模式