RLHF・DPO・GRPOはLLMを人間の価値観に合わせるアライメント技術です。ChatGPTの基盤RLHFから効率化されたDPO、DeepSeek-R1を支えるGRPOまで、仕組みと違いを初学者向けにわかりやすく解説します。
ハーバード医科大学とBeth Israel医療センターの共同研究がScience誌に掲載。OpenAI o1が救急トリアージ診断で67%の正確率を達成し、内科専門医2名(55%・50%)を上回りました。医療AIの実用化議論に新たなエビデンスが加わりました。
パイプライン並列化の「weight binding問題」を解消する新手法RoundPipeを解説します。GPUをステートレスなワーカープールとして扱うラウンドロビン方式で8×RTX 4090でのLLMファインチューニングを最大2.16倍高速化し、単一コンシューマーサーバーでQwen3-235BのLoRAチューニングを実現します。
Replit CEO Amjad Masad氏が、Cursorとの買収交渉の内幕、AppleのApp Storeブロックとの摩擦、粗利益プラスを根拠に独立を維持する戦略をインタビューで明かした。
UIUCが提案するEywaは、時系列・表形式データを扱う科学基盤モデルをLLMエージェントと統合するフレームワークです。3層設計と双方向Tsaheyluインターフェースにより、従来比7%の性能向上と30%のトークン削減を実証しました。
マスク氏が自社xAIによるOpenAIモデルの蒸留を法廷で認め、波紋が広がっています。非営利から営利への転換の合法性を問う本裁判の第1週の主要証言を解説します。
Google DeepMindが発表した「AI Co-Clinician」は、医師・AI・患者が協働する三者医療モデルを提唱。140以上の診療指標で遠隔診療AIの性能を多角的に評価します。
9BパラメータながらGemini 2.5 Flashに匹敵する視覚言語性能を実現したMiniCPM-o 4.5。Omni-Flowが可能にする全二重リアルタイム対話の仕組みと性能を解説します。
MoE(Mixture of Experts)の仕組みとDenseモデルとの違い、ゲーティング機構・負荷分散の課題から、Mixtral・DeepSeek V3・Gemma 4など主要LLMへの応用まで初学者向けにわかりやすく解説します。
スペイン・バスク大学と英カーディフ大学の研究チームが、GPT-4o-miniなど8つのLLMを独自データセットで評価。6モデルで日本が最頻参照国となる文化的偏りの実態と、その原因がファインチューニングにあることを明らかにしました。
MetaのFacebook Researchが発表したSapiens2は、10億枚の人物画像で事前学習した0.4B〜5Bパラメータの統合基盤モデルです。姿勢推定+4 mAP・法線推定誤差45.6%削減を達成し、ICLR 2026に採択されました。
OpenAIが2026年4月27日、コーディングエージェント向けオーケストレーション仕様「Symphony」をオープンソース公開しました。イシュートラッカーをAIエージェントのコントロールプレーンに変換し、一部チームでPRが500%増加した仕組みを解説します。
Agents-A1とは?35Bモデルで1兆パラメータ超の性能を達成するエージェント水平スケーリング
Mage-Flowとは?4Bで1024px画像を0.59秒生成する基盤モデル
プロンプトエンジニアリングとは?主要手法の仕組みと使い方
LLMはなぜ日本文化に偏る? 欧州研究が明かすAIの隠れた文化バイアス
PP-OCRv6: わずか34Mパラメータで235B超の大規模VLMを超えた軽量OCRシステム