大規模言語モデルLLM
LLMは大規模言語モデル(large language model)の略で、大量のテキストを学習して言語を理解・生成するAIモデルである。
LLMは大規模言語モデル(large language model)の略で、大量のテキストを学習して自然言語を理解・生成するAIモデルである。テキストの処理単位であるトークンを順に予測して応答を作る。従来の言語モデルに比べてパラメーター数と学習データの規模がはるかに大きく、多くは2017年に提案されたTransformerを基盤とする。
代表例にGPT、Claude、Geminiなどがあり、チャットボット、翻訳、要約、コード生成などに使われる。学習データが主に英語であるため言語によって性能に差が出る。パソコン上で直接動かせるLLMもある。
この説明は、AIPOSTの記事と広く知られた事実をもとにまとめたものです。誤りがあれば訂正依頼でお知らせください。
この項目を扱った記事
大規模言語モデルは、単体ではテキスト予測器にすぎません。
メールの下書きを書き、コードを組み、短い詩をつくるのと同じ種類の汎用の大規模言語モデルが、分野ごとの調整なしにこれらの分野をこなしました。
サブエージェントとLLMによる要約統合 39% 正解373件のうち統合後に残るのは217件のみ
大規模言語モデル(LLM)は、目標を形式的なコードではなく普通の英語で受け取ります。
コリソン氏はさらに、コンピューターユースをTransformer、大規模言語モデル、強化学習に続くAIの次の大きな一歩と呼びます。
市場はいま、人々が大規模言語モデルに自然な言葉で要望を伝える意図の時代に入りつつあります。
いま多くの人が大規模言語モデルをどう使っているかを考えてみます。
AIによる人類滅亡の主張は証拠のない憶測だとする一方、現在の大規模言語モデルは答えに至る過程を監査できないため、重大な判断を任せられないと論じます。
Modelsは応答を生成する大規模言語モデル(LLM)を選ぶ場所です。
大規模言語モデル、つまりプロンプトに応じて文章を生成するAIシステムは、ハルシネーションを起こすことがあります。
JAMA Network Openの診断推論試験 医師50人 大規模言語モデル単独の得点は、比較対象の医師群を約16パーセンテージポイント上回りました。
ドーキンスは未完成の小説の草稿を、Anthropicの大規模言語モデルClaudeとChatGPTに渡しました。
大規模言語モデルの中には、旧チップと比べて約4倍早く応答を始めるものがあります。