用 AI 画因果注意力掩码:挡住未来位置,要在归一以前完成 学习Transformer时,看到一个下三角格子容易记住形状,却未必知道它挡住了什么。让AI制作四个位置的可见性练习,再故意提交一个“乘零掩码”的错误版本,比只背术语更容易定位问题。 yunqueblog/ AI分享/ 2026-10-02/ 3 阅读