OpenAIは、大規模言語モデル(LLM)を活用したアプリケーションの応答速度を改善するための包括的なガイドラインを公開しました。 このガイドラインは、実際の開発現場での経験に基づいて策定され、チャットボットから細かなワ […]
Anthropic社は10月22日、同社の最速モデル「Claude 3.5 Haiku」を発表した。 同モデルは、前世代の最上位モデルであるClaude 3 Opusを多くの知能ベンチマークで上回る性能を持ちながら、Cl […]
Metaは本日、ロボット工学における画期的な進展を発表した。 同社のFundamental AI Research(FAIR)チームが開発した新しい触覚センシング技術と人間とロボットの協調に関する研究成果を公開。注目すべ […]
Anthropic社は、AIモデルの情報検索性能を大幅に向上させる新技術「Contextual Retrieval(文脈検索)」を発表した。この技術は、従来のRAG(検索拡張生成)システムの課題であった文脈の欠落問題を解 […]
本記事で使用している画像は論文中の図表、またはそれを参考に作成した画像を使用しております。 この研究のポイントは? 本論文は、Transformerモデルが不要な文脈に過剰に注意を向けてしまう問題に着目し、新しい「Dif […]
本記事で使用している画像は論文中の図表、またはそれを参考に作成した画像を使用しております。 この研究のポイントは? 本論文は、多数の会話を含む検索拡張生成(RAG)システムの評価のための新しいベンチマーク「CORAL」を […]
本記事で使用している画像は論文中の図表、またはそれを参考に作成した画像を使用しております。 この研究のポイントは? 本論文は、大規模言語モデル(LLM)の「誤った出力(ハルシネーション)」について、その原因を「知識の欠如 […]
LLM高速化手法「Self-Distillation Through Time(SDTT)」を解説。自己蒸留により投機的デコーディングを改善し、最大32トークンの同時生成を実現する仕組みと性能評価を紹介します。
本記事で使用している画像は論文中の図表、またはそれを参考に作成した画像を使用しております。 この研究のポイントは? 本論文の内容は、GPT-4の音声性能に関するもので、多様な形式の情報を処理できるモデルの特性やリスクを評 […]
本記事で使用している画像は論文中の図表、またはそれを参考に作成した画像を使用しております。 この研究のポイントは? 本論文は、異なるAIエージェントを柔軟かつスケーラブルに統合するためのプラットフォーム「AgentSto […]
本記事で使用している画像は論文中の図表、またはそれを参考に作成した画像を使用しております。 この研究のポイントは? この論文は、ポーランド語に特化した言語モデル「Bielik 7B v0.1」の開発とその評価について述べ […]
グローバル企業のブランド価値を評価する年次ランキングが発表されました。米インターブランドによる2024年版調査では、Appleが12年連続で首位を維持。ただし、同社のブランド価値は前年比3%減の4889億ドルとなり12年 […]
Agents-A1とは?35Bモデルで1兆パラメータ超の性能を達成するエージェント水平スケーリング
Mage-Flowとは?4Bで1024px画像を0.59秒生成する基盤モデル
プロンプトエンジニアリングとは?主要手法の仕組みと使い方
LLMはなぜ日本文化に偏る? 欧州研究が明かすAIの隠れた文化バイアス
PP-OCRv6: わずか34Mパラメータで235B超の大規模VLMを超えた軽量OCRシステム