一席之地
Home
Blog
Photos
Think
Works
Series
Tags
About
GitHub
搜索
⌘K
Home
Blog
Photos
Think
Works
Series
Tags
About
GitHub
Digital Garden - 数字花园
返回所有系列
《零基础学大模型原理》
从 tokenizer 与注意力机制出发,到手写一个简单 GPT,再到指令微调与 RLHF。
共
8
篇文章,按写作时间排序
1
神经网络入门:从感知机到反向传播
2022年12月20日
2
词怎么变成向量:从 one-hot 到 Word2Vec
2023年01月05日
3
Transformer 之前:RNN、seq2seq 与注意力机制
2023年01月18日
4
Transformer 详解:自注意力、多头与位置编码
2023年02月01日
5
GPT 系列:从 GPT-1 到 GPT-3 的演进逻辑
2023年02月15日
6
从 GPT-3 到 ChatGPT:指令微调与 RLHF
2023年03月01日
7
三个月零基础学大模型:收获、疑问与下一步
2023年03月20日
8
手写一个简单的 GPT:把学到的原理跑起来
2023年05月20日