ホームラボ運用– category –
ホームラボ運用の記事一覧です。Proxmox、WordPress、監視、復旧、検証環境づくりなど、壊さず試すための運用メモをまとめます。
-
ホームラボ運用
自宅サーバー監視を死活・疎通・進捗の3層で設計する
死活・疎通・進捗を分けて見ると、「正常なのに仕事が進まない」状態を扱えるようになります。監視を足す前に、いま何を観測できていないかを数えるためのS3開幕回です。 -
ホームラボ運用
3-2-1バックアップを始める時の配置表と復元確認
ディスク故障で一度すべてを失った経験は、バックアップを「あると安心な道具」から「運用の思想」に変えました。3-2-1バックアップ、復元検証、監視への執着がどこから来たのかを整理します。 -
ホームラボ運用
エッジAIと中央管理の比較:自宅ラボを統括型に寄せた理由
複数ノードに自律AIを置く構成は、可用性と局所性に強みがあります。ただし、検証・監査・方針が分散すると、幻覚、サイレント故障、設定ドリフトが静かに蓄積します。自宅ラボの運用記録から、考える場所と実行する場所を分ける理由を整理します。 -
ホームラボ運用
except: passで失敗ログが消える:収集処理のサイレント障害
2時間おきに動く健康データノードは、毎日「成功」と記録していました。しかし失敗種別のログを1行足した直後、22種中14種が毎回失敗していたことが分かりました。 -
ホームラボ運用
AIエージェントの「設定済み」を検証する3点照合
為替分析ノードで「5分待機を設定した」はずなのに、通知は毎回約1分で返ってくる。全文検索の結果、待機コードは0件でした。 -
ホームラボ運用
クォータ残量99%が更新されない:監視のstale値を見抜く
外部サービスの残量表示は99%のままなのに、実行系は枯渇エラーを返し続ける。某所ラボで起きた画面読み取り型監視の罠と、staleな値を返さないための修正を整理します。 -
ホームラボ運用
nvidia-smiが正常でもGPUハングを検知する進捗監視
GPUもAPIも正常に見えていたのに、生成だけが返らず16時間停止していました。状態監視・疎通監視・進捗監視の違いを、実測ログから整理します。 -
ホームラボ運用
UGREEN NASync DXP4800 GTを家庭ラボの中心にする前の設計表
DXP4800 GTへ保存・10GbE・Docker・VMを集約する前に、停止範囲とバックアップを確認する判断表です。 -
ホームラボ運用
MAP-EでAIエージェントのポート枯渇を切り分ける方法
深夜、冗長化していたDNSフィルタ2台が同時に上流へタイムアウトしました。10G回線で実効帯域には余裕がある。それでも繋がらない。原因は帯域ではなく、MAP-EのNATポートプールでした。 -
ホームラボ運用
自宅AIサーバーを24時間無人運用する最小構成
サーバーを置くことと、AIエージェントを24時間飼うことは違います。壊れたのはAIではなく、監視・電源・回線というインフラの前提でした。