Knowledge Dossier
公開済みEvidenceをIdentity / Capability / Credibility / Use Case / Constraints・Current Statusの軸で機械的に集約したものです(新規の主張・推測は含みません)。
Identity
- Apache Icebergは大規模分析データセット向けのオープンなテーブルフォーマット仕様であり、Netflixが開発しApache Software Foundationへ寄贈した。検証待ち Apache Iceberg公式サイト
Capability
- Icebergはスキーマ進化、パーティション進化、タイムトラベルクエリなど、レイクハウスにおけるテーブル管理の高度な機能を仕様として定義している。検証待ち Apache Iceberg Table Spec
- Icebergはオープンソースのテーブルフォーマットとして、Spark、Trino、Flinkなど複数の処理エンジンからの読み書きをサポートするよう設計されている。検証待ち Apache Iceberg Multi-Engine Support
- Databricks公式のドキュメント(Databricks製品ドキュメント)(https://docs.databricks.com/gcp/en/delta/uniform)は、Apache Icebergの連携・相互運用性に関する公的記録である。Databricks公式ドキュメントがDelta Lake Universal Format(UniForm)の仕組みについて説明しており、具体的には「DatabricksのDelta Lake Universal Format(UniForm)は、基盤となるParquetデータファイルを複製することなく、Delta Lake自体のメタデータに加えてIceberg互換のメタデータを自動生成し、同一のデータファイル群をDelta LakeクライアントとApache Icebergクライアントの双方からクエリできるようにする。」といった記載がある。ただし、対応状況は変更されうるため、この内容は取得時点のものです。 これはDatabricks自身のUniForm機能と、その利用に必要な条件(テーブルがUnity Catalogに登録されていること、特定のminReaderVersion/minWriterVersionであること等)について述べたものであり、Iceberg自体がこの橋渡し機能を提供することや、Apache HudiがIcebergと同等の相互運用性を持つことを示すものではない。2026年08月23日に同Sourceを取得し、この内容を確認した。検証待ち Apache Icebergの連携・相互運用性に関する公開情報
Constraints / Current Status
データアクセス
各APIエンドポイントはJSON形式でデータを返します。生成AIのツール呼び出し・RAG連携での利用を想定しています。