T01Transformer 架構Transformer Architecture簡短答案以自注意力機制為核心的深度學習架構,是現代大型語言模型的基礎。深入解釋2017 年由 Google 提出(論文《Attention Is All You Need》)。Transformer 能平行處理序列中所有位置的資訊,解決了 RNN 的長程依賴問題,成為 NLP 領域的主流架構。實際案例GPT、BERT、T5 等幾乎所有現代 LLM 皆以 Transformer 為基礎架構。