元Google DeepMind研究者が設立したReflection AIが、SpaceXのColossus 2データセンターと月1.5億ドルの計算資源契約を締結。GB300チップを活用したオープンウェイトAI開発戦略を解説します。
コミュニティLoRAを合成データ生成の足場として活用し、スタイルと内容を独立制御するデュアルリファレンス画像生成「FreeStyle」。注意機構レベル制約と周波数対応RoPE変調で高品質な分離を実現しました。
LLM(大規模言語モデル)が事実と異なる情報を自信満々に生成する「ハルシネーション」の仕組みを解説。3つの種類の分類から確率的トークン生成のメカニズム、RAGやプロンプト設計による実践的な対策まで一本で解説します。
Sakana AIが複数のAIモデルを動的に組み合わせる「Sakana Fugu」を発表。Fugu UltraはTerminal-Bench 2.1でFable 5を上回るなど、一部ベンチマークでフロンティアモデルを超えると主張しています。
拡散言語モデルの並列デコードを活かし、画像内の複数マスク領域を一括でキャプション生成するPerceptionDLMを解説します。スループット3.44倍を達成し、新ベンチマークParaDLC-Benchで62.4%の精度を記録しています。
Samsung Electronicsが全世界の従業員にChatGPT EnterpriseとCodexを一斉展開。OpenAI史上最大規模のエンタープライズ導入として、製造業のAI全社活用の先例を示します。
視覚言語モデルが苦手とする3D空間推論を、階層的ツールと二重メモリで克服する「S-Agent」が登場。8Bの小型モデルでもGPT-5.4やGemini 3と同等の空間知能スコアを達成した仕組みを解説します。
トランプ政権がAnthropicの最新モデルを強制オフライン化。Amazon CEOの告発が引き金となったこの措置が、OpenAIやGoogleへの需要シフトと、逆にClaudeブランドを高める逆説的効果の両面から競争地図を読み解きます。
UC Berkeleyが提案するRATs(Robotics Agent Teams)は、タスク前の「遊び」で自律的にスキルを習得するロボット学習手法です。LIBERO-PROで+20.6ポイントの精度向上を実証しました。
iOS 27では「Apple Intelligence」がOSの深部に統合され、レシート自動分割・漏洩パスワードの自動更新・通話中コンテキスト表示など実用的なAI機能が7つ追加されます。処理はすべてデバイス上で完結します。
1枚の画像からカメラ移動・物体の動き・天気変化を単一モデルで独立制御してビデオを生成する「Holo-World」を解説。新データセットと統合アダプターにより、従来は困難だった複合制御を実現しました。
SignalのメレディスウィッタカーCEOがBloombergのインタビューで「AIチャットボットは友人でも意識もない」と警告。感情的依存を演出するAI設計の問題点とプライバシーリスクを解説します。
Agents-A1とは?35Bモデルで1兆パラメータ超の性能を達成するエージェント水平スケーリング
Mage-Flowとは?4Bで1024px画像を0.59秒生成する基盤モデル
プロンプトエンジニアリングとは?主要手法の仕組みと使い方
LLMはなぜ日本文化に偏る? 欧州研究が明かすAIの隠れた文化バイアス
PP-OCRv6: わずか34Mパラメータで235B超の大規模VLMを超えた軽量OCRシステム