失敗を握りつぶさずに安く回す — Gemini 3.5 Flash を前提にしたエージェント再試行予算の設計
エージェントの再試行を「握りつぶし」と区別し、失敗を分類してから予算の範囲で回す設計です。Gemini 3.5 Flash の速度と価格を根拠に、1タスクあたりの再試行上限とログ、週次の締め直しまでを実装の手順で整理しました。
複数案を出させたあと、どれを採用するか — 検証で裁定する Best-of-N の設計
Gemini 3.5 Flash の速さで、同じ実装を複数案つくらせるのは現実的になりました。難しいのは生成ではなく裁定です。多数決でも自己申告の自信でもなく、検証可能な信号だけで採用案を決める Best-of-N アービターの設計と TypeScript 実装を共有します。
ダイアログが重なる前に止める — 課金・レビュー誘導・リワード広告を1か所のゲートで束ねる
ペイウォール・レビュー誘導・リワード広告が同じ瞬間に重なって出る不具合を、優先度つきの中央ゲートで根治した実装記録です。Antigravityのエージェントに散らばったshow()呼び出しの掃き出しを任せ、表示ポリシーは自分で握る線引きで進めました。
どのエージェントがいくら使ったかを会計する — タスク別コスト帰属の設計
月末の請求は1つの数字でも、Gemini 3.5 Flash で複数エージェントを走らせていると、どのタスクが費用を食ったかが見えません。予算で止めるガードとは別に、使用量をタスク別・サイト別の原価へ帰属させる会計設計を、個人運用の実装と数値で共有します。
Antigravity の LLM アプリは、ダッシュボードが緑のまま請求と品質がずれていく — 観測の計装メモ
LLM アプリの監視は、合計のコストとレイテンシだけ見ていると静かなずれを見逃します。機能・テナント・プロンプト版で属性付けし、品質劣化とコスト急増を早期に捕まえる計装の設計メモです。
並行エージェントの動きを後から辿る — 構造化ログとスパンで作る可観測性
Antigravity 2.0 のデスクトップで複数エージェントを並行させると、どれが何をしているか追えなくなります。混線する print デバッグを捨て、run_id と span で実行を後から辿れるようにする可観測性の設計を、個人運用の実装と数値で共有します。
Antigravity CLI が無人実行中に 401 で止まるとき — 認証切れと再ログイン待ちを切り分ける
Antigravity CLI を無人のスケジュール実行に組み込んだあと、ある朝から 401 が一度出て止まる症状の原因と、認証切れと再ログイン待ちを切り分けて自動運用を立て直す手順をまとめます。
Antigravity vs Gemini Code Assist の選び方 2026 — Google の2大AI開発ツールはどう違う?
AntigravityとGemini Code Assistは、どちらもGoogleが提供するAI開発ツールです。本記事では両者の違いを機能・コスト・ユースケース別に徹底比較し、あなたに最適な選択を解説します。
Antigravityの生成コードが『正しいのに、よそよそしい』と感じたら試したい3つの指示
Antigravityの生成物が『動くのに自分のコードベースに馴染まない』と感じたときに見直したい、設計意図の渡し方。指示の文脈不足を埋める3つのパターンと、それでも噛み合わなかったケースを実体験から整理しました。
Antigravity vs OpenAI Codex どちらを選ぶ? AIコーディングエージェント比較 2026
GoogleのAntigravityとOpenAIのCodex、どちらを選ぶべきか。アーキテクチャ・機能・価格・得意分野を実務目線で比較し、両者の使い分けまで具体的にお伝えします。
Managed Agents の無人バッチを再実行で壊さない — 冪等性とチェックポイントの設計
Antigravity 2.0 の Managed Agents API で夜間バッチを組むと、途中失敗からの再実行が必ず問題になります。二重実行で投稿が重複した失敗を起点に、冪等キー・チェックポイントストア・再開ロジックの実装を、個人開発の運用実数値とともに共有します。
axe-core の検出をエージェントに渡して直す — アクセシビリティ改善を CI に組み込む実装メモ
axe-core で検出したアクセシビリティ違反を Antigravity のエージェントに渡し、検出→トリアージ→修正→再検証のループを CI に組み込む実装メモです。新規違反だけを止める差分ゲートと、エージェントの修正範囲を絞る設計を本番運用の形でまとめました。