注: 以下の翻訳の正確性は検証されていません。AIPを利用して英語版の原文から機械的に翻訳されたものです。
AIP、Foundry、Apollo はすべて、Palantir Rubix ↗ と呼ばれる、セキュリティを強化した、自動スケーリングと高可用性を備える Kubernetes 実装上で稼働します。
Rubix は、Palantir が数十年にわたり培ってきた安全なソフトウェアの開発の経験を基に、オープンソースのコンテナー化がもたらす主要な利点を、世界で最も厳しい要件が求められる環境での運用に必要な機能で拡張することを目指して開発されました。これには、入れ替え周期が強制適用される短命なコンピュートノード、デフォルトで安全なネットワーク、動的かつインテリジェントな自動スケーリング、そして FedRAMP High、DOD DISA IL-5/IL-6、CMMC を含む最も厳格な認定基準を満たす幅広い機能が含まれます。
Rubix のアーキテクチャは、当初 Palantir 自身のソフトウェアをホストするために開発されましたが、現在ではあらゆる規模のソフトウェア企業が、世界で最も制約が厳しく複雑な環境を含め、選択した任意の環境に自社製品をデプロイするために使用しています。
Rubix の設計の根幹には、妥協を許さず相互に結び付いた前提があります。ミッションクリティカルなソフトウェアは、設計段階から安全で、高可用性を備え、迅速に進化できなければなりません。

Rubix は、戦術的な攻撃と高度な持続的脅威の両方の攻撃経路を軽減するように設計されています。
すべてのワークロードは必要な要件に基づいて安全に分離されており、昇格した権限を必要とする運用タスクを安全に実行できます。これらのタスクは、厳密に管理された権限で動作するアプリケーション主導の実行とは区別されます。環境内のすべての要素にわたって暗号化が厳格に強制され、ワークロード間のすべてのインタラクションは、不変の設定に従って認証、認可、ログ記録を行う必要があります。
Palantir は、この安全で自動スケーリングを備えたパラダイムを Spark コンピュートランタイムで先駆けて実現するために、Rubix の初期バージョンを開発しました。現在、このパラダイムは、システム接続の管理、データ統合、モデル管理、アプリケーション開発、エージェントの構築から開発者ツールチェーンまで、AIP、Foundry、Apollo 内のすべてのランタイムとサービス構造に広がっています。

高可用性は、Rubix がノードを短命に保つアプローチと密接に結び付いています。Rubix 環境内のノードは、48時間を超えて稼働できません。これにより、ユーザー向けの Ontology Manager であれ、ストリームを加工するバックエンドサービスであれ、すべてのサービスが中断と耐障害性のあるフェイルオーバーを前提として設計されます。また、古くなったインスタンスは自動的に置き換えられ、その置き換えを制御するロジックには世界各地の稼働実績から得た知見が組み込まれているため、Rubix はインフラストラクチャチームによる手動対応の必要性も減らします。
セキュリティの観点では、ノードを短い周期で入れ替えることで、攻撃者が1個のノードを侵害しても、それだけでは環境への永続的なアクセスを獲得できないようにします。運用面では、この短命性が、ポリシーに基づくノード選択を利用する多次元のノードドレインおよび終了パイプラインと連携し、円滑に不安定化を回避します。
Rubix は、インフラストラクチャチーム、プラットフォームチーム、顧客チームのいずれにも効率化をもたらします。Palantir の主要サービスに安全で一貫した基盤を提供することで、インフラストラクチャチームは AIP、Foundry、Apollo、およびそれらに依存する製品やサービスを、AWS、Azure、Google Cloud、Oracle Cloud、オンプレミス環境のいずれにも、同一の運用特性でデプロイできます。
マネージドインフラストラクチャに新しい機能やサービスをリリースする Palantir のチームに対して、Rubix は、環境やプロバイダーごとの特有の事情を抽象化する、信頼性の高い統一された基盤を提供します。
カスタムアプリケーション、コンテナー化されたモデル、その他の Kubernetes 準拠ワークロードを安全にホストしたい顧客の開発者は(たとえば Compute Module を通じて)、Rubix の主要な利点をすべて、特別な対応なしに活用できます。これには、インテリジェントなワークロード分散、高度な需要検知アルゴリズムの数々、継続的なコスト最適化を促進するその他の機能が含まれます。
Rubix は Apollo と連携し、「Day 2」のインフラストラクチャ運用のための強力な統制機能を提供します。
Apollo の役割の1つは、特定の Palantir 環境にある数百のサービスのそれぞれについて、インストール、アップグレード、ロールバックのプランを計算し、送信することです。
ダウンタイムなしのアップグレードを確実に行うために、Apollo は、すべてのソフトウェアサービスを「ブルー/グリーン」ロールアウト戦略向けに設計されたマルチノード構成でデプロイすることを要求します。一括ロールアウト戦略とは異なり、ブルー/グリーンのパラダイムでは、まず並列のグリーン環境を構築し、既存のブルー環境とともにそのパフォーマンスを監視します。グリーン環境が指定された期間にわたって正常に動作した場合、トラフィックはブルーノードからグリーンノードへ徐々にリダイレクトされます(そしてブルーノードは、強制適用される入れ替え周期に従って破棄されます)。
このダウンタイムなしのアーキテクチャは、明確な設計方針を組み込んだ Rubix の API レイヤーなしでは実現できません。Apollo はこのレイヤーを利用し、複雑なデプロイの意図を、サービス作成、ステータス監視、製品リビジョン管理、設定管理などのためのリソースレベルの指示に変換します。
Rubix は、Palantir の「一度記述すれば、どこにでもリリースできる」という開発理念の基盤を提供します。Rubix は Kubernetes の主要な利点に、世界で最も重要な環境へソフトウェアを迅速にリリースするために必要なセキュリティ、高可用性、デプロイ容易性の機能を加え、それらの利点をさらに強化します。
Rubix は、Palantir の開発者チームを支援するだけでなく、現在では、規制対象の環境に独自のエンドツーエンドソリューションをデプロイしたいソフトウェアチームも支援しています(Palantir FedStart を通じて FedRAMP への準拠を実現できます)。
Rubix はまた、Mission Manager を通じて、政府機関全体がベンダーのオンボーディングと管理を安全に迅速化できるようにします。Palantir の顧客やパートナーが最も重要なミッションを追求し、ソフトウェアインフラストラクチャを長年支配してきた時代遅れの常識に挑み続ける中、Rubix は、その最も差し迫ったニーズを支えるために進化し続けます。