StorageGRID プラットフォーム サービスのトラブルシューティング
プラットフォームサービスで使用されるエンドポイントは、テナントユーザーがテナントマネージャーで作成および管理します。ただし、テナントがプラットフォームサービスの設定や使用に関して問題を抱えている場合は、グリッドマネージャーを使用して問題を解決できる可能性があります。
新しいエンドポイントに関する問題
テナントがプラットフォームサービスを利用するには、まずテナントマネージャーを使用して1つ以上のエンドポイントを作成する必要があります。各エンドポイントは、1つのプラットフォームサービスの外部宛先を表します。たとえば、StorageGRID S3バケット、Amazon Web Servicesバケット、Amazon Simple Notification Serviceトピック、Kafkaトピック、またはローカルもしくはAWSでホストされているElasticsearchクラスターなどです。各エンドポイントには、外部リソースの場所と、そのリソースにアクセスするために必要な認証情報の両方が含まれています。
テナントがエンドポイントを作成すると、StorageGRID システムは、エンドポイントが存在すること、および指定された認証情報を使用してアクセスできることを検証します。エンドポイントへの接続は、各サイトの1つのノードから検証されます。
エンドポイントの検証が失敗した場合、エラーメッセージに失敗した理由が表示されます。テナントユーザーは問題を解決してから、エンドポイントの作成を再度試みてください。
|
|
テナントアカウントでプラットフォームサービスが有効になっていない場合、エンドポイントの作成は失敗します。 |
既存のエンドポイントに関する問題
StorageGRID が既存のエンドポイントへのアクセスを試みた際にエラーが発生した場合、Tenant Manager のダッシュボードにメッセージが表示されます。

テナントユーザーは、エンドポイントページにアクセスして、各エンドポイントの最新のエラーメッセージを確認し、エラーが発生した日時を特定できます。「最終エラー」列には、各エンドポイントの最新のエラーメッセージが表示され、エラーが発生した日時が示されます。
アイコンが表示されているエラーは、過去7日以内に発生したものです。

|
|
*最終エラー*列に表示されるエラーメッセージの中には、括弧内に logID が含まれている場合があります。グリッド管理者またはテクニカルサポート担当者は、このIDを使用して、bycast.log 内のエラーに関する詳細情報を確認できます。 |
プロキシ サーバに関する問題
ストレージノードとプラットフォームサービスエンドポイント間に"ストレージプロキシ"を設定している場合、プロキシサービスが StorageGRID からのメッセージを許可しないと、エラーが発生する可能性があります。これらの問題を解決するには、プロキシ サーバの設定を確認して、プラットフォームサービス関連のメッセージがブロックされていないことを確認してください。
エラーが発生したかどうかを確認します。
過去7日以内にエンドポイントエラーが発生した場合、テナントマネージャーのダッシュボードに警告メッセージが表示されます。エラーの詳細については、エンドポイントのページをご覧ください。
クライアント操作が失敗しました
プラットフォームサービスの一部の問題により、S3バケットに対するクライアント操作が失敗する可能性があります。例えば、内部の Replicated State Machine (RSM)サービスが停止した場合、または配信待ちのプラットフォームサービスメッセージが多すぎる場合、S3クライアントの操作は失敗します。
サービスのステータスを確認するには:
-
ノード > サイト > ストレージノード > 概要 を選択します。
-
アラートテーブルでアクティブなアラートを確認してください。
-
発生しているアラートをすべて解決してください。必要に応じて、テクニカルサポートにお問い合わせください。
回復可能なエンドポイントエラーと回復不可能なエンドポイントエラー
エンドポイントが作成された後、プラットフォームサービスのリクエストエラーは、さまざまな理由で発生する可能性があります。一部のエラーは、ユーザーの介入によって回復可能です。例えば、回復可能なエラーは次のような理由で発生する可能性があります:
-
ユーザーの認証情報が削除されたか、有効期限が切れています。
-
宛先バケットが存在しません。
-
通知を送信できません。
StorageGRID で回復可能なエラーが発生した場合、プラットフォーム サービス要求は成功するまで再試行されます。
その他のエラーは回復不可能です。例えば、以下のような理由で回復不可能なエラーが発生する可能性があります。
-
エンドポイントは削除されました。
-
ウェブフックエンドポイントの宛先が、通知リクエストに対して `400 Bad Request`エラーで応答します。
StorageGRID で回復不能なエンドポイントエラーが発生した場合:
-
Grid Manager で、「サポート」>「ツール」>「メトリクス」>「Grafana」>「プラットフォームサービス概要」に移動して、エラーの詳細を確認します。
-
テナントマネージャーで、STORAGE (S3) > Platform Services Endpoints に移動して、エラーの詳細を確認してください。
-
関連するエラーについては、 `/var/local/log/bycast-err.log`を確認してください。ADC サービスを含むストレージノードには、このログファイルが含まれています。
プラットフォームサービスメッセージを配信できません
宛先側でプラットフォームサービスメッセージの受信を妨げる問題が発生した場合、バケットに対するクライアント操作は成功しますが、プラットフォームサービスメッセージは配信されません。たとえば、宛先で認証情報が更新され、StorageGRID が宛先サービスへの認証を実行できなくなった場合に、このようなエラーが発生することがあります。
関連するアラートを確認してください。
プラットフォームサービスリクエストのパフォーマンスが低下しています
StorageGRID ソフトウェアは、S3 バケットへの受信リクエストの送信速度が、宛先エンドポイントがリクエストを受信できる速度を超えた場合、受信リクエストを制限する可能性があります。スロットリングは、宛先エンドポイントへの送信を待機しているリクエストのバックログが存在する場合にのみ発生します。
唯一目に見える影響は、受信する S3 リクエストの実行に時間がかかるようになることだけです。パフォーマンスが著しく低下し始めた場合は、取り込み速度を下げるか、より容量の大きいエンドポイントを使用してください。リクエストのバックログが増大し続けると、クライアントの S3 操作(PUT リクエストなど)は最終的に失敗します。
CloudMirror のリクエストは、検索統合やイベント通知のリクエストよりもデータ転送量が多いため、宛先エンドポイントのパフォーマンスの影響を受けやすい傾向があります。
プラットフォームサービスリクエストが失敗しました
プラットフォームサービスの要求失敗率を確認するには:
-
* Nodes * を選択します。
-
サイト > *プラットフォームサービス*を選択します。
-
リクエストエラー率のグラフを確認します。

プラットフォームサービスが利用できないというアラート
Platform services unavailable アラートは、RSM サービスが稼働しているか利用可能なストレージノードが少なすぎるため、サイトでプラットフォームサービス操作を実行できないことを示します。
RSMサービスは、プラットフォームサービスのリクエストがそれぞれのエンドポイントに確実に送信されるようにします。
このアラートを解決するには、サイト内のどのストレージノードにRSMサービスが含まれているかを特定してください。(RSMサービスは、ADCサービスも搭載しているストレージノードに存在します。)次に、それらのストレージノードの過半数が稼働中で利用可能であることを確認してください。
|
|
同一サイトにおいて、RSMサービスを含むストレージノードが複数故障した場合、そのサイトに対する保留中のプラットフォームサービス要求はすべて失われます。 |
プラットフォームサービスエンドポイントに関する追加のトラブルシューティングガイダンス
詳細については、"テナントアカウントを使用する > プラットフォームサービスのエンドポイントのトラブルシューティング"を参照してください。