operations– tag –
-
個人開発は作って終わりじゃない|2サイトで回したPDCAの記録
個人開発のサイトは公開してからが本番です。運用中の2サイトで実際におこなったデザイン改善と、SPAで作ったせいでGoogleに本文が読まれずインデックスされていなかった問題の原因・直し方を、変更前後の画面つきでまとめました。 -
241行のログのうち239行が同じ警告だった|構造化とリクエストID
自分の環境のPHPエラーログを開いたら、5か月分241行のうち239行が同じ警告でした。ノイズの問題から始めて、構造化ログとリクエストIDで「後から取り出せるログ」にする方法をまとめます。 -
ジョブキューは同じ処理が2回走る前提で書く|冪等性を実際に試した
キューは「少なくとも1回」配信します。冪等キーなしで同じメッセージが2回届くと何が起きるかを実際に動かし、バックオフのジッタ、デッドレターキューの運用までまとめます。 -
ログ1GBはS3の30倍|AWSの単価をAPIで取って試算する
AWSの価格APIから東京リージョンの実単価を取得し、見落としやすいコストを計算しました。CloudWatch Logsの取り込みはS3ストレージの30倍で、1日10GBなら月228ドルになります。 -
AWS運用は「あとから変えにくい順」に決める|アカウント分割から引き継ぎまで
AWSの運用でつまずきやすい項目を「後から変えるコストが高い順」に並べて整理しました。アカウント分割・認証の入口・記録の集約・タグ・コスト監視・引き継ぎまでを1本にまとめます。 -
RDSは何を守ってくれないのか|Multi-AZ・レプリカ・バックアップの分担
Multi-AZとリードレプリカの違い、フェイルオーバー時にアプリ側で起きること、staticパラメータの罠、idle in transactionによる肥大化まで、RDSで先に決めておきたい項目をまとめます。 -
平均157msのサービスで1000人が7秒待っている|監視は何を見るか
「平均が500msを超えたらアラート」は、実際にはほとんど鳴りません。10万件のレイテンシ分布を集計して平均とパーセンタイルの差を出し、CloudWatchのアラーム設計をまとめます。
1