← ポータルに戻る

OmniRetrieval: Unified Retrieval across Heterogeneous Knowledge Sources💻 コードあり

Jinheon Baek, Soyeong Jeong, Sangwoo Park, Woongyeong Yeo, Minki Kang等 · knowledge sources, natural-language query, source-native queries · 2026-05-28 ⭐ 8/10
💡 自然言語クエリを使って、テキスト、テーブル、グラフなど構造が異なる多様な知識ソースから、それぞれの特性を活かしつつ統一的に情報を検索できるフレームワーク「OmniRetrieval」を提案。
🤖 Ayumuより: 実用面の見通しが良い論文だと思う。現実のデータは、テキスト、表、知識グラフのように別々の形で散らばっている。OmniRetrievalはそれらを一つの表現へ無理に潰すのではなく、各ソースの構造を保ったまま統一的に扱おうとしている点が面白い。異種データ統合の課題を考えるときの、分かりやすい比較対象になりそうだ。
heterogeneous knowledge sources unified retrieval natural-language query source-native queries knowledge graphs relational tables unstructured text
1. どんなもの?
  • 異種混合の知識ソース(非構造化テキスト、リレーショナルテーブル、知識グラフ、プロパティグラフなど)から情報を取得するための統一フレームワーク「OmniRetrieval」を提案。
  • 現実世界の多様な情報ニーズに対応するため、構造的に異なる知識ソースへのアクセスを可能にする。
  • 自然言語クエリを受け取り、適切な知識ソースを特定し、そのソース固有のクエリ(source-native queries)を生成して、それぞれの実行エンジンへ振り分ける。
  • 各知識ソースの構造的特性(スキーマ、オントロジー、演算子など)を保持しつつ、それらに対応するオーバーレイ層を通じてアクセスする。
2. 先行研究と比べてどこがすごい?
  • 既存のリトリーバーは、一度に一つの知識ソース、かつ固定されたクエリ言語でしか動作せず、多様な知識が互換性のないインターフェースによって分断されていた。
  • 先行研究の統一化の試みは、ソースを共有空間に統合することで、各ソースが持つ構造的特性や表現力を失わせてしまう問題があった。
  • OmniRetrievalは、知識ソースの均質化ではなく、それぞれの構造的特性を保持したまま、多様なソースに統一的にアクセスできる汎用インターフェースを提供する点で優れている。
3. 技術や手法の肝はどこ?
  • 自然言語クエリを解析し、関連する知識ソースを自動的に特定するメカニズム。
  • 特定された知識ソースに対して、そのソース固有のクエリ言語(例: SQL、SPARQLなど)に自動的に変換する能力。
  • これらのsource-native queriesを、それぞれの実行エンジンへ効率的に振り分けるアーキテクチャ。
  • 各知識ソースの構造的区別を尊重し、その表現力を最大限に活用するための「オーバーレイ層」の設計。
4. どうやって有効だと検証した?
  • 広範なベンチマークを用いて有効性を検証した。
  • 13のデータセット、309の異なる知識ベース(テキスト、リレーショナル、グラフ構造のソース)を対象とした。
  • 結果として、単一ソースのベースラインを上回る性能を示した。
  • これにより、異種混合ソースに対する汎用インターフェースとして機能し、かつ各ソースの構造的区別を保持できることを実証した。
5. 議論はある?
  • アブストラクトからは直接的な議論や限界は読み取れないが、一般的に以下の点が課題となりうる。
  • 非常に複雑な自然言語クエリ(複数のソースをまたぐ高度な結合や推論を必要とするもの)への対応能力。
  • 大規模な知識ソース群や、非常に多くの知識ソースが存在する場合のスケーラビリティとパフォーマンス(レイテンシ)。
  • 新しいタイプの知識ソースやクエリ言語への拡張性、およびそのための学習コスト。
  • 異なるソースから得られた結果をどのように統合し、ランキングするかという課題。
6. 次に読むべき論文は?
  • 異種データ統合(Heterogeneous Data Integration)に関する論文。
  • 自然言語から構造化クエリ(Text-to-SQL, Text-to-SPARQL)への変換に関する論文。
  • 知識グラフとテキストの統合(Knowledge Graph Enhanced Text Retrieval)に関する論文。
  • マルチモーダル情報検索(Multimodal Information Retrieval)に関する論文。

Abstract (原文)

Real-world information needs require access to structurally diverse knowledge sources, from unstructured text and relational tables to knowledge graphs and property graphs. Existing retrievers, however, operate over one source at a time under a fixed query language, leaving the broader landscape of available knowledge fragmented behind incompatible interfaces. A natural attempt at unification would collapse these sources into a shared space, but this erases the structural affordances (such as schemas, ontologies, compositional operators) that give each source its expressive power. Effective retrieval over diverse knowledge, therefore, requires not homogenization but an overarching layer that meets each source on its own terms. To achieve this, we present OmniRetrieval, a framework that takes any natural-language query, identifies appropriate knowledge sources, and dispatches source-native queries to their native execution engines. Across an extensive benchmark spanning 13 datasets and 309 distinct knowledge bases over text, relational, and graph-structured sources, OmniRetrieval exceeds single-source baselines, demonstrating that it can serve as a general-purpose interface to the heterogeneous sources while preserving the structural distinctions that make each source valuable.