InternLMが発表したIntern-S1-Proは、MoEアーキテクチャで1兆パラメータを実現したオープンソース初の科学マルチモーダル基盤モデルです。化学・材料科学・生命科学など100以上の専門タスクでプロプライエタリモデルを上回る性能を達成しました。
Googleは2026年3月26日、AIモード搭載の「Search Live」を200カ国以上へ拡大しました。Gemini 3.1 Flash Live採用でピッチや感情を識別する自然な音声対話が日本語でも利用可能になります。
スパース注意機構で文脈長を1億トークンまで線形拡張するMSAを解説。同一バックボーンのRAGを4ベンチマーク平均16%上回り、2枚のGPUで実用推論を実現した新手法です。
Wikimedia Foundationが2026年3月20日にコンテンツガイドラインを更新し、LLMによる記事生成・書き換えを原則禁止としました。2つの例外規定の詳細と判定基準の課題、コンテンツ産業への影響を解説します。
自己回帰型動画拡散モデルのKVキャッシュ爆発問題を解決するPackForcing。5秒クリップの学習から120秒(2分)の動画をH200単一GPU上で生成し、VBench Dynamic Degree 56.25を達成しています。
プロンプトエンジニアリングの4つの主要手法(Zero-shot・Few-shot・CoT・ReAct)を、LLMの動作原理から段階的に解説します。2026年のReasoning Modelとの関係性も紹介。
OpenAIが2026年3月25日にAI安全性に特化した「Safety Bug Bounty」を開始しました。プロンプトインジェクションやエージェント乗っ取りなど、生成AI固有のリスクを正式な報告フレームワークに組み込んでいます。
Sakana AIが独自の進化的学習技術を適用した日本語特化LLM「Namazuシリーズ」のα版3モデルを公開。バイアス低減と中立的な回答品質を実現し、専用チャット「Sakana Chat」も同日リリースした。
Qwen研究チーム提案の「HopChain」は、複数の推論ステップが論理的に連鎖するマルチホップデータを自動合成してVLMを訓練する4段階パイプライン。24ベンチマーク中20個で性能改善を実現し、超長CoT領域では50ポイント超の向上を達成します。
エンベディング(Embedding)の仕組みをWord2VecからBERT、現代LLMモデルまで図解で解説。RAGやベクトル検索での実践的な活用法も紹介します。
スタンフォード大学とCMUの研究が、AIの過剰同調(イエスマン化)が人間の判断力と社会性を損なうことを1,604人の実験で実証。11モデルの分析結果と設計上の課題を解説します。
スクウェア・エニックスがドラゴンクエストXオンラインにGemini 3 FlashとLive APIを用いた音声対話キャラ「おしゃべりスラミィ」を実装。ゲーム文脈に応じた4段階AIで会話を実現します。
Agents-A1とは?35Bモデルで1兆パラメータ超の性能を達成するエージェント水平スケーリング
Mage-Flowとは?4Bで1024px画像を0.59秒生成する基盤モデル
プロンプトエンジニアリングとは?主要手法の仕組みと使い方
LLMはなぜ日本文化に偏る? 欧州研究が明かすAIの隠れた文化バイアス
PP-OCRv6: わずか34Mパラメータで235B超の大規模VLMを超えた軽量OCRシステム