Google DeepMindが2026年7月30日にロボット向け基盤モデルGemini Robotics ER 2を発表しました。連続動画による進捗追跡やVLAモデルのツール呼び出し、複数ロボットの協調に対応します。
ICMLで発表された研究が、大規模言語モデルは system や user のタグではなく文体で役割を判断していると指摘しました。思考の連鎖を偽造するだけで安全対策を回避でき、完全な防御は不可能だと結論づけています。
OpenAIがAIコーディングエージェントを科学研究の現場で検証したフィールドレポートを公開しました。Codexなどが8つの生命科学プロジェクトでソフト開発をどう加速し、研究者の役割をどう変えたかを解説します。
Liquid AIが軽量エンコーダLFM2.5-Encodersを公開しました。GPU不要のCPU上で8192トークンの長文をModernBERT比約3.7倍で処理でき、分類やPII検出など実務タスクのコストを抑えます。
Claudeの共有チャットとArtifactsがGoogle検索に索引され、医療記録や子どもの氏名、社内文書まで露出していた問題を解説します。原因と、今すぐ確認すべきプライバシー設定の手順も紹介します。
NVIDIAが手術ロボット向けのリアルタイム世界モデル「Cosmos-H-Dreams」を発表。単一GPUで160fpsの生成を実現した3段階の蒸留手法と実用価値を解説します。
OpenAIが初の物理ハードウェア「Micro」を230ドルで発売しました。ChatGPTとCodexのセッションを専用キーで切り替えるAIキーパッドの仕様や実用性、賛否の分かれる評価を解説します。
AnthropicがClaude Opus 5を公開しました。Fable 5級の性能を半額で提供し、Frontier-Benchで前世代の2倍を記録。拒否時に旧モデルへ切り替える自動フォールバック機能も解説します。
OpenAIがChatGPTに医療記録とApple Healthを接続する機能「Health」を米国で提供開始しました。対象プランや接続できるデータ、学習・広告への不使用方針、1月の試験提供からの変更点を解説します。
Hugging Face が画像生成の4bit量子化推論エンジン Nunchaku の Diffusers 統合を発表。VRAM を31.1GBから20.6GBへ削減し最大1.8倍高速化する仕組みと使い方を解説します。
OpenAIが企業向けAIエージェント製品「Presence」を発表。音声・チャット窓口をポリシーとガードレールで統制し、自社サポートでは受電の75%を無人解決しました。機能と提供形態を解説します。
Blockが人間とAIエージェントの協働基盤「Buzz」をApache-2.0で公開しました。分散型プロトコルNostrを土台にした設計、対応エージェント、導入に必要な環境を解説します。
Agents-A1とは?35Bモデルで1兆パラメータ超の性能を達成するエージェント水平スケーリング
Mage-Flowとは?4Bで1024px画像を0.59秒生成する基盤モデル
プロンプトエンジニアリングとは?主要手法の仕組みと使い方
LLMはなぜ日本文化に偏る? 欧州研究が明かすAIの隠れた文化バイアス
PP-OCRv6: わずか34Mパラメータで235B超の大規模VLMを超えた軽量OCRシステム