Datadog のAWS Lambda モニタリング | Datadog

DatadogでAWS Lambda をモニタリング

サーバーレス・アーキテクチャの完全な可視性を確保し、パフォーマンスの問題を迅速にトラブルシューティングします。

詳細はこちら

登録にかかる時間はわずか30秒。クレジットカードは不要です。

詳細はこちら

登録にかかる時間はわずか30秒。クレジットカードは不要です。

serverless-service-map_v2
case-studies/resources_nttdocomo_casestudy

「クラウドでの開発と運用を進めるなか、Datadogを導入した目的 は統合監視ツールで様々な事象を関連付けて分析することです。 可観測性が上がり、問題の切り分けから対応までが迅速化するだ けでなく、開発者はAPMでただちに性能試験もできて、ボトルネ ックをすぐ発見できる。我々はビジネスロジックに集中し、アジ リティを高めたい。そうした要件があるなかDatadogはSaaSで提 供されているので運用負荷が低く、マルチクラウドにも対応し ているところがよかった。」

株式会社NTTドコモ

サービスデザイン部 第三クラウド推進

担当部⻑ 三井 力 氏


課題

かつて現場では、開発と運用間のコミュニケーションに課題があった。トラブルの切り分けに時間が かかっていた。運用で問題が起きたらすぐに解 決したかった。

Datadog による効果

Datadogは様々な事象を関連付けて分析ができて、可観測性が高まり、対処までの時間を短縮できる。ダッシュボードの表現力、使い勝手、人気ランキングが表示されるなどの機能がメンバーを魅了し、有益なダッシュボードが次々と生まれた。DatadogがSaaS型で運用負荷が低く、マルチクラウド対応しているところもよかった。

case-studies/resources_ikyu_casestudy

「システムの健全性を把握するために必要な情報(メトリクスやログ)が散在していたため、異常発生時には複数のツールにまたがり原因を探す必要があり、職人技と運が必要でした。また、リリースのタイミングでパフォーマンスが落ちることがあり、クエリーやロジックをレビューするなど試行錯誤していました」

植竹 剛人 氏

CISO 兼データサイエンス部 部⻑ 兼CTO室 エンジニア

株式会社 一休


課題

メトリクスやログなどあちこちに情報があり、障害が起きたときにどこに問題があるのか職人技で探す必要があった。リリースのタイミングでパフォーマンスが落ち、サイトがタイム・アウトしてユーザーから見えないこともある。最優先の課題は、リアルタイムな統合モニタリングでエンドユーザーが気づく前に問題を解決可能になることでした。

Datadog による効果

システムのクラウド移行に伴い、SaaS型で運用負荷が少ない監視ツールを探したところ、Datadogが目についた。メトリクスが豊富で、ダッシュボードから必要な情報を一覧できて、Slackとの連携しやすいさなどが魅力だった。【問題対処を迅速化】プロダクト開発が責任をもって運用までおこなっている。インフラや外形監視でほぼリアルタイムで通知を受け、APMで問題解決とシームレスに対応ができるようになった。【デプロイが10倍以上に】2週間に1度だったデプロイをDatadog導入とともに自動化を進めた結果、1日数回へと大幅に頻度を上げられた。

case-studies/resources_softbank_casestudy

「Datadogを活用したDevOps基盤が構築できて、豊富なモニタリングとコスト最適化が実現できました。Datadogはマルチクラウドを意識することなく可視化できて、アプリとインフラ担当の共通言語となっています。今後はセキュリティ強化にも役立てていきたいと考えています」

ソフトバンク株式会社

コアネットワーク本部

クラウド基盤R&D統括部 クラウドネイティブ技術部

担当部⻑

山根 武信 氏


課題

ビジネスニーズの変化はめまぐるしく、開発現場は度重な る仕様変更に翻弄されていた。 そこで2018年、仕様変更に柔軟かつ素早く対応するため、アジャイル開発とDevOps環境構築に乗り出した。開発サイクルを加速させるためには、 DevOps環境における運用監視作業の省力化はもちろん、開発の様々な場面で可視化を実現する必要があった。

Datadog による効果

新たに構築したアジャイル開発 とDevOps基盤はクラウドのコン テナ Kubernetes環境なので、そ れまで使用していた監視ツール では不向きだった。コンテナに 対応した監視ツール各種で比較 したところ、Datadogは構築工 数やオンプレ連携、必要な機能 が揃い管理工数を低く抑えられ る統合ツールだったため採用。 開発から運用まで、あらゆる段 階で幅広く可視化できるのも大 きなメリットとなった。

case-studies/resources_assetforce_casestudy

「取れる指標でなく、「人」を中心に通知を設計したことがDatadogの導入成功の鍵でしょう。適切な人に、次のアクションに繋がる情報を緊急度に応じた媒体で伝えることが重要です。通知が多すぎると、人は慣れて無視されて、肝心なときに役に立ちません。」

三井住友ファイナンス&リース株式会社

デジタル開発室 リードスペシャリスト 森本 悠太 氏


課題

三井住友ファイナンス&リースグループは、短期間でモニタリング環境を構築して、開発と運用を一体化し、システムの稼働を安定させる必要がありました。

Datadog による効果

三井住友ファイナンス&リースグループは、短期間でのモニタリング環境導入のため、シンプル、必要な機能を最初から使える、初期設定のまますぐに使えるダッシュボード、APIで細かくTwillioの通知フローを設定できる、機密性が高いログの除外に対応しているという 5つの理由からDatadogを選定しました。

多くの企業で愛用され信頼を得ています

Samsung logo Ubisoft logo Deloitte Cloud logo Cybozuinc logo sansan logo Nginx logo Chef logo Nasdaq logo DreamWorks Animation logo Nikon logo Zynga logo Evernote logo Sonos logo Monotaroco logo

製品のメリット

すべての関数の情報を一箇所に集約

サーバーレスの重要なメトリクスを 1 か所に集約して俯瞰的に確認し、1 回のクリックで単一の呼び出しをドリルアップ
  • エラー、高レイテンシー、またはコールドスタートを発生させている関数をフィルタリングしてパフォーマンスを最適化
  • タグを活用して、クラウドリージョン、割り当てられたメモリ、環境などで関数をグループ化
  • ハイレベルな関数の問題を特定し、ワンクリックで呼び出しのトレースとログにピボット

サーバーレスのパフォーマンス問題のトラブルシューティングの高速化

サービスアーキテクチャ全体にまたがるインシデントを迅速に検出し、解決します。
  • エンドツーエンドのトレース、レイテンシーのブレークダウン、リクエストレベルの詳細を示すフレームグラフにより、サーバーレス・アーキテクチャの完全な可視性を獲得
  • EC2、ECCS、API Gateway、Amazon SNSなど、450以上のベンダーがサポートする統合機能を使用して、問題の発生源を詳細に把握
  • ホストとLambda関数のログ、ラムダメトリクス、分散リクエストトレースをシームレスにナビゲートすることで、根本原因の分析をより迅速に

完全なサーバーレス関数の観測性

サーバーレス関数のインシデント診断を簡素化します。
  • リアルタイムのスクリーンボードとサービスマッピングを使用して、ボトルネック、同時実行制限、コールドスタート、コードレベルの問題、サービスの依存関係を簡単に特定
  • 個々の顧客のリクエストを分離し、関連するログとメトリクスをドリルダウンして詳細な情報を得えられます
  • サービス、顧客、またはエラーコードなどのタグを使用して検索およびフィルタリングして、エフェメラルな関数のトラブルシューティングを可能に

追加のオーバーヘッドなしでビジネスメトリクスを追跡

呼び出しでリソースのオーバーヘッドを増やすことなく、サーバーレス関数からカスタムのビジネスメトリクスを収集します。
  • 開発、運用、ビジネスチームのための統合情報源で組織の間の壁をなくします
  • 機能から直接メトリクスを収集して、カート内のアイテム数やカート内のアイテムの値などのデータを追跡
  • カスタマイズ可能なリアルタイムのダッシュボードで主要なビジネスデータを可視化および分析
serverless/serverless-4-image-business-metrics.png

重要なサーバーレス指標の効率的な分析

パフォーマンスとコスト削減のために、不十分なプロビジョニングや誤った構成のサーバーレス関数に対処します。
  • メモリ、タイムアウト、割り当てられた同時実行メトリクスの予測に関するアラートにより、エンドユーザーのエクスペリエンスの低下をプロアクティブに防止
  • Watchdogを使用して、予期せぬ異常、異常、エラーを自動的に検出
  • どの関数がエラーを発生させているのか、また個々のLambda関数にどのようなエラーが発生しているのかを簡単に特定

Datadogを始める5つのステップ

ステップ1
トライアル登録フォームに入力 わずか30秒で無料でアカウントを作成。クレジットカードは不要
ステップ2
技術スタックに関する基本的な質問に回答 約1分で完了
ステップ3
Datadog エージェントをインストール システムレベルのメトリクスをDatadogプラットフォームに送信
ステップ4
API経由で追加のメトリクスを取得するための認証情報を提供 AWS、Azure、GCPなどのクラウド環境を完全に可視化
ステップ5
すぐに使えるダッシュボードでパフォーマンスを視覚化 環境全体のパフォーマンスをリアルタイムで確認可能

Real results from Datadog customers

12B Log events each day, managed cost-effectively
EA DICE
<2 min Mean time to resolution (MTTR)
CITIZENS BANK
50% Cost savings on cloud resources
TRAVELSUPERMARKET

クラウド時代に不可欠なモニタリングとセキュリティのプラットフォーム

Datadogは、エンドツーエンドのトレース、メトリクス、ログを統合し、アプリケーション、インフラストラクチャ、サードパーティ・サービスを完全に可観測にします。

Platform Diagram

800+ 以上のすぐに使えるインテグレーション

なぜDatadogなのか?

すぐに使えるダッシュボード

セットアップ後すぐに、データがロードされ調査がはじまります


Watchdogによる異常の自動検出

Watchdogを利用することで設定や操作なしに、自動で環境の異常を発見します


800以上の統合機能

Datadogがサポートする統合機能で、任意のテクノロジーを幅広くカバーします。


各業界大手で実証済み

様々な業界のFortune 100の大企業が、Datadogを信頼しています