Appearance
证明字符级语言模型的两条最短路径都是通的:查表式的 bigram 计数矩阵能采样出像样的“人名”,参数化的 MLP 语言模型会在受控训练数据上让交叉熵 loss 真的下降。
→ 在第4章正文里查看完整命令、预期输出与故障注入