第1回目の連載(ChatGPTの心臓部『Transformer』って何がすごいの?)はコチラ!
「最近、ChatGPTやGeminiが、前より賢くなった気がする」——その感覚には、ちゃんと理由があります。
AIの進化は、第1話で紹介したTransformerのような大発明だけで起きるわけではないのです。データの学習方法や推論、評価手法など、ITエンジニアたちの工夫と改善の積み重ねが今のAIを支えています。
「じゃあ、その工夫や改善って、具体的に何をしているの?」
「今のAIの進化の裏にあるのは何なの?」
――その答えは、このマンガの中にあります。読み終わる頃には、あなたもバッチリ説明できるようになっていますよ!
なぜ賢くなった? 進化の裏にある4つの秘密



※ RLHF(Reinforcement Learning from Human Feedback):人間のフィードバックによる強化学習

※RLVR(Reinforcement Learning with Verifiable Rewards):検証可能な報酬を用いた強化学習




