AIがどう学び育つのか、学習・訓練にかかわる用語です。
収録98語- Context Parallelism
- DAPO
- DiffusionBlocks
- DoRA
- DPO
- Expert Parallelism
- Expert Tensor Parallelism
- FSDP エフエスディーピー
- GenRM
- GPSampler ジーピーサンプラー
- GRPO
- GSPO ジーエスピーオー
- IPO
- KTO
- k平均法 けーへいきんほう
- k近傍法 けいきんぼうほう
- LLMブレインロット
- LoRA ローラ
- M2N2
- Muon
- NLHF
- Optuna オプチュナ
- ORPO
- Outcome Reward Model
- PEFT
- PPO
- Q-learning
- QLoRA
- REINFORCE++
- RLAIF
- RLHF アールエルエイチエフ
- RLOO
- RLVR
- Rubrics as Rewards
- SAPO
- Sequence Parallelism
- SFT
- SimPO シンポ
- SPPO
- VAPO
- WebWorldData
- Weka ウェカ
- ZeRO ゼロ
- アノテーション
- オプティマイザ
- 回帰 かいき
- 過学習 かがくしゅう
- カテゴリ変数
- カリキュラム学習 カリキュラムがくしゅう
- 学習 がくしゅう
- 学習可能システム がくしゅうかのうしすてむ
- 学習率 がくしゅうりつ
- 強化学習 きょうかがくしゅう
- 強化ファインチューニング きょうかふぁいんちゅーにんぐ
- 教師あり学習 きょうしありがくしゅう
- 教師なし学習 きょうしなしがくしゅう
- クラスタリング
- 訓練データ くんれんデータ
- 検証データ けんしょうデータ
- 混合精度学習 こんごうせいどがくしゅう
- 合成データ ごうせいでーた
- 識別モデル しきべつモデル
- 指示チューニング しじチューニング
- 進化的モデルマージ しんかてきもでるまーじ
- 時間差分学習 じかんさぶんがくしゅう
- 次元削減 じげんさくげん
- 自己教師あり学習 じこきょうしありがくしゅう
- 自己報酬型言語モデル じこほうしゅうがたげんごモデル
- 事前学習 じぜんがくしゅう
- 生成モデル せいせいモデル
- 対照学習 たいしょうがくしゅう
- 単純ベイズ分類器 たんじゅんべいずぶんるいき
- 知識蒸留 ちしきじょうりゅう
- テキストトゥローラ
- テストタイムトレーニング
- 転移学習 てんいがくしゅう
- テンソル並列
- データセット
- 特徴量 とくちょうりょう
- ドメイン特化型言語モデル ドメインとっかがたげんごモデル
- 長さバイアス ながさバイアス
- ハイパーパラメータ
- 破滅的忘却 はめつてきぼうきゃく
- 汎化性能 はんかせいのう
- パイプライン並列
- パラメータ
- 表現学習 ひょうげんがくしゅう
- ファインチューニング
- ブースティング
- プロセス報酬モデル
- 報酬シェイピング ほうしゅうシェイピング
- 報酬モデル ほうしゅうモデル
- 補助損失なし負荷分散 ほじょそんしつなしふかぶんさん
- マルコフ決定過程 まるこふけっていかてい
- マルチトークン予測
- モデルマージ
- ラベル
- ランダムフォレスト