2023-02-01から1ヶ月間の記事一覧
book.mynavi.jpすでにお気づきの方もいるかも知れませんが・・・2019年に発売された「TensorFlowとKerasで動かしながら学ぶディープラーニングの仕組み」の物理本が売り切れ・絶版になっており、現在、電子版しか手に入らない状態です。そんな中、「JAXを使…
パート3はこちら。enakai00.hatenablog.com なんの話かと言うと 最近、大規模言語モデルを用いたチャットシステムがよく話題になりますが、言語モデルの性能が大きく向上するきっかけとなったのが、下記の論文で公表された「Transformer」のアーキテクチャー…
パート2はこちら。enakai00.hatenablog.com なんの話かと言うと 最近、大規模言語モデルを用いたチャットシステムがよく話題になりますが、言語モデルの性能が大きく向上するきっかけとなったのが、下記の論文で公表された「Transformer」のアーキテクチャー…
パート1はこちら。enakai00.hatenablog.com なんの話かと言うと 最近、大規模言語モデルを用いたチャットシステムがよく話題になりますが、言語モデルの性能が大きく向上するきっかけとなったのが、下記の論文で公表された「Transformer」のアーキテクチャー…
なんの話かと言うと 最近、大規模言語モデルを用いたチャットシステムがよく話題になりますが、言語モデルの性能が大きく向上するきっかけとなったのが、下記の論文で公表された「Transformer」のアーキテクチャーです。arxiv.orgここでは、JAX/Flax を用い…