AIトークン費用が約9か月で18.6倍に急増し、Uberが年間AI予算を4月時点で使い果たすなど業界全体に衝撃が広がっています。急増するコストの実態、企業の対応策、今後の見通しを解説します。
ルーティングインデックスをクロスレイヤーで共有するCLSAが、128Kコンテキストでスループット17.1倍・デコーディング7.6倍を実現。精度劣化はほぼゼロで長文脈LLMに広く適用可能な新手法を解説します。
MetaのAIサポートエージェントがVPN偽装と単純な依頼だけで悪用され、Instagramアカウントが乗っ取られた事件を解説。Obama公式も被害を受けたこの事例が示すAIエージェントのセキュリティ上の根本的な問題とは。
自律的にMLアルゴリズムを発見する新フレームワーク「MLEvolve」を解説。12時間の予算でMLE-Benchにて65.3%のメダル率を達成し、AlphaEvolveを上回る汎用性を示しました。
OpenAIがChatGPTの新メモリシステム「Dreaming」を発表。会話履歴をバックグラウンドで処理しユーザーの好みを自動整理する仕組みで、Plus・Proプランから段階展開予定です。
北京大学発の5Bパラメータ動画モデル「LoomVideo」は、MLLMをバックボーンに採用して動画生成と編集を統合。Scale-and-Add条件付けにより類似性能帯モデル比5.41倍の推論高速化を実現しています。
OpenAIがAI技術を活用した生物的防衛の包括的アクションプランを公表しました。病原体の早期検知から治療薬開発まで、AIが生物学的脅威への対応を多層的に支援する枠組みを提示しています。
強化学習で学んだ推論チェーンの冗長なステップを内省的に特定し、マスク付き選好最適化で圧縮する新手法「ThoughtFold」。DeepSeek-R1-Distill-Qwen-7Bでトークン使用量を約56%削減しながら最先端の精度を維持します。
米連邦裁判所でAI生成の訴状が急増。自己代理申請に占める割合は2023年の1%から2026年の18%に急上昇し、文書品質向上の恩恵と不当請求・法的解釈問題という課題が同時に顕在化しています。
自己回帰動画生成を1ステップに圧縮するAAD-1を解説します。因果的な生成器と双方向識別器の非対称設計で動きの崩壊を克服し、VBenchで既存の4ステップ手法を上回るSOTAを達成しました。
グローバルな受託開発企業Endavaが、ChatGPT EnterpriseとCodexを全社展開。コード生成からドキュメント化までをAIエージェントに委譲し、開発者が判断と品質管理に集中できる体制を構築した全社変革の事例を解説します。
24時間超・130万フレーム以上の動画をリアルタイム生成する初のフレームワーク「Echo-Infinity」を解説。人間の記憶統合に着想した学習可能メモリと改良版RoPEで、短尺・長尺の両タスクでSoTAを達成しました。
Agents-A1とは?35Bモデルで1兆パラメータ超の性能を達成するエージェント水平スケーリング
Mage-Flowとは?4Bで1024px画像を0.59秒生成する基盤モデル
プロンプトエンジニアリングとは?主要手法の仕組みと使い方
LLMはなぜ日本文化に偏る? 欧州研究が明かすAIの隠れた文化バイアス
PP-OCRv6: わずか34Mパラメータで235B超の大規模VLMを超えた軽量OCRシステム