
MySQLのメタデータロック待ちで障害発生…再発防止策を仕組みに落とし込むまで
クラウドソーシングサービス「クラウドワークス」(crowdworks.jp)のエンジニアをしている原です。 今年で新卒3年目になりますが、先日初めて自分のデプロイが原因でサービス障害を引き起こしてしまいました。現在はその再発防止策を策定し、運用に乗せるべく動いているところです。 この記事では、今回の障害の技術的な原因と、既存の開発フローやAIを活用した再発防止策について紹介します。
まだブックマークされていません
X に入る文: MySQLのメタデータロック待ちで障害発生…再発防止策を仕組みに落とし込むまで