Datadog Monitoring | Datadog

Datadog で Kafka のパフォーマンスをモニタリング

ダッシュボードの1画面にリアルタイムのBroker、Producer、Consumerのメトリクスを表示し、重要な事象のみをアラートで受け取れます。

無料のデモを今すぐ視聴

登録にかかる時間はわずか30秒。クレジットカードは不要です。

無料のデモを今すぐ視聴

登録にかかる時間はわずか30秒。クレジットカードは不要です。

dashboard-body-kafka
case-studies/resources_nttdocomo_casestudy

「クラウドでの開発と運用を進めるなか、Datadogを導入した目的 は統合監視ツールで様々な事象を関連付けて分析することです。 可観測性が上がり、問題の切り分けから対応までが迅速化するだ けでなく、開発者はAPMでただちに性能試験もできて、ボトルネ ックをすぐ発見できる。我々はビジネスロジックに集中し、アジ リティを高めたい。そうした要件があるなかDatadogはSaaSで提 供されているので運用負荷が低く、マルチクラウドにも対応し ているところがよかった。」

株式会社NTTドコモ

サービスデザイン部 第三クラウド推進

担当部⻑ 三井 力 氏


課題

かつて現場では、開発と運用間のコミュニケーションに課題があった。トラブルの切り分けに時間が かかっていた。運用で問題が起きたらすぐに解 決したかった。

Datadog による効果

Datadogは様々な事象を関連付けて分析ができて、可観測性が高まり、対処までの時間を短縮できる。ダッシュボードの表現力、使い勝手、人気ランキングが表示されるなどの機能がメンバーを魅了し、有益なダッシュボードが次々と生まれた。DatadogがSaaS型で運用負荷が低く、マルチクラウド対応しているところもよかった。

case-studies/resources_ikyu_casestudy

「システムの健全性を把握するために必要な情報(メトリクスやログ)が散在していたため、異常発生時には複数のツールにまたがり原因を探す必要があり、職人技と運が必要でした。また、リリースのタイミングでパフォーマンスが落ちることがあり、クエリーやロジックをレビューするなど試行錯誤していました」

植竹 剛人 氏

CISO 兼データサイエンス部 部⻑ 兼CTO室 エンジニア

株式会社 一休


課題

メトリクスやログなどあちこちに情報があり、障害が起きたときにどこに問題があるのか職人技で探す必要があった。リリースのタイミングでパフォーマンスが落ち、サイトがタイム・アウトしてユーザーから見えないこともある。最優先の課題は、リアルタイムな統合モニタリングでエンドユーザーが気づく前に問題を解決可能になることでした。

Datadog による効果

システムのクラウド移行に伴い、SaaS型で運用負荷が少ない監視ツールを探したところ、Datadogが目についた。メトリクスが豊富で、ダッシュボードから必要な情報を一覧できて、Slackとの連携しやすいさなどが魅力だった。【問題対処を迅速化】プロダクト開発が責任をもって運用までおこなっている。インフラや外形監視でほぼリアルタイムで通知を受け、APMで問題解決とシームレスに対応ができるようになった。【デプロイが10倍以上に】2週間に1度だったデプロイをDatadog導入とともに自動化を進めた結果、1日数回へと大幅に頻度を上げられた。

case-studies/resources_softbank_casestudy

「Datadogを活用したDevOps基盤が構築できて、豊富なモニタリングとコスト最適化が実現できました。Datadogはマルチクラウドを意識することなく可視化できて、アプリとインフラ担当の共通言語となっています。今後はセキュリティ強化にも役立てていきたいと考えています」

ソフトバンク株式会社

コアネットワーク本部

クラウド基盤R&D統括部 クラウドネイティブ技術部

担当部⻑

山根 武信 氏


課題

ビジネスニーズの変化はめまぐるしく、開発現場は度重な る仕様変更に翻弄されていた。 そこで2018年、仕様変更に柔軟かつ素早く対応するため、アジャイル開発とDevOps環境構築に乗り出した。開発サイクルを加速させるためには、 DevOps環境における運用監視作業の省力化はもちろん、開発の様々な場面で可視化を実現する必要があった。

Datadog による効果

新たに構築したアジャイル開発 とDevOps基盤はクラウドのコン テナ Kubernetes環境なので、そ れまで使用していた監視ツール では不向きだった。コンテナに 対応した監視ツール各種で比較 したところ、Datadogは構築工 数やオンプレ連携、必要な機能 が揃い管理工数を低く抑えられ る統合ツールだったため採用。 開発から運用まで、あらゆる段 階で幅広く可視化できるのも大 きなメリットとなった。

case-studies/resources_assetforce_casestudy

「取れる指標でなく、「人」を中心に通知を設計したことがDatadogの導入成功の鍵でしょう。適切な人に、次のアクションに繋がる情報を緊急度に応じた媒体で伝えることが重要です。通知が多すぎると、人は慣れて無視されて、肝心なときに役に立ちません。」

三井住友ファイナンス&リース株式会社

デジタル開発室 リードスペシャリスト 森本 悠太 氏


課題

三井住友ファイナンス&リースグループは、短期間でモニタリング環境を構築して、開発と運用を一体化し、システムの稼働を安定させる必要がありました。

Datadog による効果

三井住友ファイナンス&リースグループは、短期間でのモニタリング環境導入のため、シンプル、必要な機能を最初から使える、初期設定のまますぐに使えるダッシュボード、APIで細かくTwillioの通知フローを設定できる、機密性が高いログの除外に対応しているという 5つの理由からDatadogを選定しました。

多くの企業で愛用され信頼を得ています

Samsung logo Ubisoft logo Deloitte Cloud logo Cybozuinc logo sansan logo Nginx logo Chef logo Nasdaq logo DreamWorks Animation logo Nikon logo Zynga logo Evernote logo Sonos logo Monotaroco logo

製品のメリット

Apache Kafka のパフォーマンス問題解決を高速化

  • 完全なレイテンシブレークダウン、エンドツーエンドのアプリケーション・トレース、スタック・トレースにより、ボトルネックやエラーを簡単に特定
  • 非常に粒度の高いサーバー(ブローカー)、プロデューサー、コンシューマー、Zookeeper のメトリクスを収集
  • ホストレベルのメトリクス、クリーンでないリーダーの選出、リクエストの待ち時間、消費者の遅延など、実用的なアラートを受信
  • 直感的なロギング・プラットフォームと自動パターン認識により、遅いクエリ・ログを迅速に分析
dashboard-body-kafka.jpg

主要な Kafka メトリクスを他のスタックと一緒にモニタリング

  • Datadogの450以上のベンダーがサポートする統合機能を使用して、クラウドサービス、オンプレミスサーバー、コンテナ、サーバーレス機能のすべてを一箇所でモニタリング
  • カスタムの Apache Kafka 解析ダッシュボードをドラッグアンドドロップで数秒で作成
  • ログ、インフラストラクチャのメトリクス、アプリケーションのトレースをすべて1つのプラットフォーム内でシームレスにナビゲート
ProductVideoDashboard_HD.jpg

インフラストラクチャ内の問題を自動的に顕在化

  • Watchdogを使ってITインフラストラクチャの異常を数秒で検出
  • クラウドとオンプレミスのすべてのサーバーを俯瞰的に表示し、1クリックで個々のホストをドリルダウンで調べるられます
  • コンテナが作成され、破棄されるとすぐにモニター
  • 粒度の高いデータとカスタム・メトリクスをリアルタイムで可視化

アプリの信頼性とチーム間のコラボレーションを向上

  • 根本原因を迅速に診断し、相関関係を使用してワンクリックですべてのシステムの異常な動作を確認
  • インフラストラクチャのメトリクス、アプリケーションのトレース、ログを一枚のガラスの中に表示
  • SlackやPagerdutyなどのワークフロー統合を使用して、パフォーマンスの問題を迅速に伝達可能
  • 時間同期されたグラフにイベントを重ね合わせることで、仮説を簡単にテストできます

重要な問題のみアラートを受信し、誤検出を排除

  • 日・週・季節の変動を考慮した異常値・異常値のアラート設定
  • 指標予測に基づくアラートにより、障害やエラーを未然に防止
  • ブーリアンロジックに基づく複合アラートを作成し、偽のアラートへの対応時間を短縮
  • Watchdogで予期せぬ異常値、アノマリー、エラーを自動検知
products/alerts/watchdog-machine-learning-alerts.jpeg

Datadogを始める5つのステップ

ステップ1
トライアル登録フォームに入力 わずか30秒で無料でアカウントを作成。クレジットカードは不要
ステップ2
技術スタックに関する基本的な質問に回答 約1分で完了
ステップ3
Datadog エージェントをインストール システムレベルのメトリクスをDatadogプラットフォームに送信
ステップ4
API経由で追加のメトリクスを取得するための認証情報を提供 AWS、Azure、GCPなどのクラウド環境を完全に可視化
ステップ5
すぐに使えるダッシュボードでパフォーマンスを視覚化 環境全体のパフォーマンスをリアルタイムで確認可能

Real results from Datadog customers

12B Log events each day, managed cost-effectively
EA DICE
<2 min Mean time to resolution (MTTR)
CITIZENS BANK
50% Cost savings on cloud resources
TRAVELSUPERMARKET

クラウド時代に不可欠なモニタリングとセキュリティのプラットフォーム

Datadogは、エンドツーエンドのトレース、メトリクス、ログを統合し、アプリケーション、インフラストラクチャ、サードパーティ・サービスを完全に可観測にします。

Platform Diagram

800+ 以上のすぐに使えるインテグレーション