コンテンツへスキップ

Transformer

現代の LLM を支えるニューラルネットワークアーキテクチャ。自己注意で全トークンを並列処理する。

2017年の論文「Attention Is All You Need」で提案され、リカレントネットワークに取って代わり大規模学習を可能にした。今日の著名な LLM はほぼすべて Transformer の派生。

関連リソース