お問い合わせ

コミュニティに参加

WeChat でスキャン
公式コミュニティグループに参加

Guance を体験

オンラインで従量課金のクラウドサービスを開始できます。

無料で始める

Guance エディションを選択

コードリポジトリ

Unified Observability Platform

統合監視プラットフォームソリューション

R&D、SRE、運用・保守、プラットフォームチーム向けには、分析指標、ログ、リンク、RUM、プロファイル、Kubernetes、クラウドリソース、ビジネス指標、AI分析、アラートイベントを統合し、故障トラブルシューティングが同じ文脈に基づいて行えます。

統合監視プラットフォームとは何ですか?

統合監視プラットフォームを用いて、メトリクス、ログ、トレース、RUM、プロファイル、Kubernetes、クラウドリソース、イベント、ビジネスメトリクスを中央集約・収集・保存・照会し、チームがシステム異常が発生する理由、どのサービスやユーザーが影響を受け、誰が同じ文脈で処理すべきかを理解できるようにします。 Guanceは単にAPM、ログ、インフラ監視、アラートを一括りにするだけでなく、サービス、ホスト、ポッド、インターフェース、アクセスセッション、公開、ビジネスオブジェクトに関する関係構築を図り、R&D、SRE、オペレーション、プラットフォームチームがツール切り替えを減らし、データ標準を統一し、故障のローカライゼーション効率を向上させるのを支援することです。

統合監視プラットフォームは実際の本番の故障をどのように処理しているのでしょうか?

統一された監視プラットフォームを評価する際には、単にメトリクスやログ、リンクを見るだけでは不十分です。むしろ、本当の故障が症状から根本原因・行動へと移行するかどうかを確認することがさらに重要です。

マイクロサービスのインターフェースが突然遅くなる

Java/Spring Cloudサービスがインターフェースのタイムアウト、エラー率の増加、注文失敗が発生した場合、APM Trace、アプリケーションログ、データベースの遅いクエリ、Redis/Kafkaの指標、Podの状態、リリースイベントを同じトラブルシューティングループに関連付けGuance。

R&DやSREはアラートやビジネス指標から始まり、特定のインターフェース、依存関係、SQL、インスタンス、バージョン、または責任あるチームを特定し、Prometheus、ELK、SkyWalking、クラウドコンソール間の往復を減らすことができます。

入口アラートやビジネス指標
証拠トレース + ログ + SQL
戦闘ポジショニングサービスと責任者

異常はKubernetesリリース後に発生します

新しいバージョンがリリースされると、ポッドの再起動、5xxインターフェース、CPUスパイク、Kafka消費遅延などが発生します。GuanceKubernetesイベント、コンテナログ、サービストポロジー、リソースレベル、変更ログは同じタイムラインに配置されます。

プラットフォームチームは、異常が画像バージョン、リソース制約、ノードの圧力、依存性の非利用不可、または設定変更によるものかを判断し、対応するチームにロールバック、スケーリング、レート制限、または構成修正を割り当てて実行させます。

入口リリース変更とポッドイベント
証拠リソース+ログ+サービストポロジー
戦闘ロールバック、スケーリング、または修復構成

フロントエンドの体験は低下しますが、バックエンドは普通のようです

ウェブページがホワイトスクリーン、JSエラー、リソースの読み込みが遅い、キー変換がドロップした場合、GuanceRUMの実際のユーザー体験モニタリング、APIリクエスト、バックエンドトレース、CDN/ゲートウェイログ、地域運用者の次元を分析します。

ビジネス、フロントエンド、バックエンドの各チームは、ページリソース、ブラウザエラー、インターフェースのタイムアウト、ネットワーク経路、バックエンド依存関係などの問題を特定でき、サーバーの指標だけに注目せず、ユーザー体験への実際の影響を見落とすことを避けられます。

入口RUMの経験と転換の異常
証拠JSエラー+API + トレース
戦闘フロントエンド、ゲートウェイ、バックエンドの依存関係を修正する

なぜ企業には統一された監視プラットフォームが必要なのでしょうか?

APM、ログ、メトリクスは文脈的に切り離されています:単一のインターフェースのタイムアウトには、アプリケーションのトレース、エラーログ、ポッドの再起動、遅いデータベースクエリ、ユーザーアクセスの体験が含まれることがあります。データが複数のツールに分散している場合、トラブルシューティングは手動でタイムラインを作成する必要があります。

複数のチームが同じ証拠を欠いている:R&D、SRE、オペレーション、プラットフォーム、ビジネスチームは異なる視点を捉えているため、「これは私の問題か?」という繰り返しのコミュニケーションが容易になり、サービスやリソース、バージョン、責任者を直接特定するのではなくなっています。

クラウドネイティブおよびマルチクラウド環境は急速に変化します:Kubernetesポッド、コンテナ、ノード、ワークロード、クラウドリソース、リリースイベントは常に変化しており、静的モニタリングでは真の依存関係や影響範囲を反映するのが困難です。

アラームノイズは故障応答に影響を与える:同じ障害が複数の種類のアラートを引き起こす可能性があり、オブジェクトの関係性、ビジネスへの影響、ルートコンテキストが欠けている場合、チームは優先順位付けや重複通知の削減が困難になります。

Guanceデータの監視とトラブルシューティングのプロセスを統合する方法は?

観察可能なデータへの統一アクセス:DataKit、OpenTelemetry、RUM SDK、クラウドベンダー統合、ログ収集を通じて、メトリクス、ログ、リンク、RUM、プロファイル、イベント、インフラ、ビジネスデータが単一のデータ基盤に統合されます。

オブジェクト関係と統一タグの確立:サービス、ホスト、ポッド、コンテナ、クラウドリソース、インターフェース、アクセスセッション、ビジネスオブジェクトに関する関連付けを確立し、単一のアラートでトレース、ログ、リソース、影響範囲をさらに掘り下げることができます。

フルリンク故障位置プロセスの形成:ユーザー体験の低下、インターフェースの遅さ、エラー率の増加、ポッドの再起動、ビジネス指標の異常などから、サービス、依存関係、バージョン、リソース、チームリーダーを統一されたタイムライン上で特定しましょう。

アラート、AI分析、レビューのループを閉じました:異常検出、アラート通知、イベントセンター、Obsy AI分析、メモ取り、レビューが一つのプラットフォームに統合され、重複アラートや情報のギャップを減らします。

統合監視プラットフォームのコア機能

よくある質問

観測可能性プラットフォームとは何ですか?

この観測可能性プラットフォームは、メトリクス、ログ、リンク、RUM、Profile、Kubernetes、クラウドリソース、イベント、ビジネスメトリクスを一様に収集・相関させるために使われ、チームが同じ文脈からシステムの状態、ユーザー影響、根本原因を理解するのに役立ちます。

観測プラットフォームと従来のモニタリングの違いは何ですか?

従来のモニタリングは固定された指標やアラートに重点を置くのに対し、観測可能性プラットフォームは指標、ログ、トレース、RUM、インフラ、ビジネスデータ間の相関分析を重視し、実際のデータを用いてシステムの異常を説明します。

観測可能性プラットフォームと統合監視プラットフォームの関係は何でしょうか?

統合された監視プラットフォームは、複数の監視機能の集中管理を重視しています。 この観測可能性プラットフォームは、オブジェクト関係、文脈的関連付け、探索的解析、故障クローズをさらに重視しています。 Guance同時に統合された監視および観測可能な分析能力もカバーしています。

プロメテウス、ELK、グラファナはまだGuanceと繋がることができるのでしょうか?

はい、できます。 Guanceはオープンスタンダードと複数のデータソースアクセスをサポートし、チームは既存の収集機能を維持しながら、統一されたクエリ、アラート、相関分析、コラボレーションのエントリーポイントを確立できます。

観測可能性プラットフォームはどのようにMTTRを削減しているのでしょうか?

タイムラインの統一、サービスオブジェクトとリソースオブジェクト間の関係、ログチェーンジャンプ、RUMとAPMの関連付け、AI支援分析、アラートコンテキストの統合により、ツールの手動切り替えや証拠の組み立てにかかる時間を削減します。

統合モニタリングプラットフォームソリューションの実装経路に合わせて、Guance

デモを予約