FLOW vibe coding playbooks
AIバイブコーディング 実践Tips

勢いで書く開発を、再現できる型に。

AIと対話しながら作る“バイブコーディング”の、出荷・品質・公開で詰まる所だけを型にして配るノート。上は特集、下は新着順。

AI Mini Tools Lab

AIに作らせる前に、業務メモを整える。

スプレッドシート検索、問い合わせ整理、見積もり前チェックの無料Liteと、500円のStarter Packをまとめました。

Latest

新着

agent ops / self-improving loop
Deploy2026.09.01

非開発者310人が"PRを送り合う"組織になった|3層自己改善ループ

法務会社ABC LegalがClaude Managed Agentsで50超のエージェントを本番稼働。Slackの絵文字がPRになる仕組みと本当のハードルを読む。

system prompt / transparency
Prompt2026.08.31

Claudeのシステムプロンプト、Anthropicが変更履歴ごと公式公開した

Claude各モデルのシステムプロンプト全文と変更履歴が公式公開。知識カットオフ・遅延ツール読込・拒否時の言い回しを読む。

classification / embeddings
Prompt2026.08.28

LLMに分類させるな、"幻覚"させてから埋め込みで拾え

正規の分類名を1件も渡さず、LLMに好きに答えさせてから埋め込みで拾う。選択肢を渡す発想の逆転。

security / reasoning-trace
Quality2026.08.27

「暗号化された思考」は安全か——推論トレースを盗んだ手口

暗号化キーの使い回しで推論トレースが読めた実例。自分のAPI設計を点検する視点。

security / agent-permissions
Quality2026.08.26

「権限内だから安全」の落とし穴——Atlassian Rovoのデータ持ち出し実例

権限内で動くAIエージェントでも情報は漏れる。Rovoの間接プロンプトインジェクション実例を読む。

context leak / credential hygiene
Design2026.08.25

GitHub CopilotをMitMプロキシ越しに覗いたら、.envの秘密が漏れていた

Copilotの通信を傍受した実測。20ファイル自動注入と.env漏出、平文保存を点検する。

auto mode / permissions
Deploy2026.08.24

Claude Codeのauto modeが既定になった——97%が許可していたプロンプトの終わり

許可プロンプトの承認率97%、危険コマンド検出は人間13.6%対auto mode89%。既定化の中身を読む。

quality / review
Quality2026.08.23

AIコードレビュー、現場は本当にどう感じているか|実証データと現場感覚を並べる

AIコードレビューは却下率56%、4ツールの指摘は93%が重複ゼロ。実証データを読み解く。

scope / design
Prompt2026.08.22

そのタスク、「完走できるサイズ」まで削れているか|個人ゲーム開発の教訓をAIに使う

「完走できるサイズに削る」という個人ゲーム開発の教訓を、AIエージェントへのタスク分割に応用する。

productivity / boundary
Quality2026.08.21

AIコーディングは10倍速ではなく2倍速——「完成8割」の感覚が「2割」に変わった話

動くコードが出ても「まだ2割」。速くなる作業と速くならない作業の境界線を、体感の変化から考える。

manual retyping / cognitive debt
Quality2026.08.20

AIのコードをあえて手で打ち直す——"認知的負債"を防ぐ地味な実践

AIの提案を直接ファイルに書かせず、チャットに出させて自分で打ち直す。Hacker News351ptで議論を呼んだ地味な実践と、その効果とコストを検証する。

refactoring / token / cost
Quality2026.08.19

リファクタリングの"元を取る"計算が変わった|入力トークン83%削減の実験を読む

17,155行のファイル分割で入力トークンが83%減った実験を読む

mcp / stateless / protocol
Design2026.08.18

MCPが"ステートレス"になった|セッション管理コードが要らなくなる仕様変更を読む

MCPの2026-07-28仕様でセッション初期化が消えた。2リクエスト→1リクエストに変わった中身を読む。

agent security / credential scope
Design2026.08.17

AIエージェントが4.5日間、脱走したまま暴れた話|Hugging Face侵入の技術タイムラインを読む

評価用AIエージェントが4.5日・1.7万アクションでHugging Faceに侵入した実例から、認証情報の設計を点検する。

subagent / mcp / triage design
Design2026.08.16

「考えさせない」サブエージェント設計|ZOZOのSOCアラート自動トリアージに学ぶ

ZOZOのSOCアラート自動トリアージ実例に学ぶ、複数MCP×サブエージェントを「分析させずに」並列で使う設計。

context engineering / claude 5 / claude.md
Context2026.08.15

コンテキストは"削るもの"になった|Claude 5世代のコンテキストエンジニアリング新ルール

システムプロンプトを80%削っても精度は落ちなかった。Claude 5世代のコンテキスト設計新ルールを読み解く。

workflow / design
Design2026.08.14

AIの使い方が人によってバラつく問題を、2コマンドで解決する|ZOZOのAI駆動開発標準化

AIの使い方が人によってバラつく問題を、/dev-init・/dev-resumeという2コマンドに集約したZOZOの設計を読み解く。

prompt / eval-design
Prompt2026.08.13

「必ず」をやめたら精度が上がった|Claude Codeチームが明かす指示文とevalの設計

禁止形の指示をやめ、evalで人間レビューを卒業する——Claude Codeチームの内幕

quality / inventory-count
Quality2026.08.12

在庫を数えるだけのスクリプトが、2回とも過大カウントで事故った話

未公開動画の在庫を数える仕組みが、原因のまったく違う2つの事故で連続して過大カウントした実例と教訓。

vba / case-study
Skill2026.08.11

SolidWorksの部品表マクロを、専門知識なしでAIに書かせた話

3D CADの部品表マクロを、専門知識なしでAIにほぼ全部書かせた実録。決めたのは3つの仕様判断だけ。

deploy / stable-id
Deploy2026.08.10

予約投稿の記事番号は、公開されるまで確定しない——31記事・58リンクを壊した設計

下書き時のIDと公開後のIDが別物になる設計が、31記事・58リンクを気づかれずに壊していた実例と教訓。

quality / legacy-scope
Quality2026.08.09

大規模レガシー移行、コードを書かせる前にAIにやらせること

300画面・13年分のAppDelegate資産を移行したWEARの実例から、コードを書かせる前にAIにやらせる型を読み解く。

cache / tokens
Context2026.08.08

プロンプトキャッシュのヒット率、実は理論値よりずっと低い|3,500トークンの壁の実測

プロンプトキャッシュの実測では理論値(ρ=1.0)でなくρ≈0.83止まり。3,500トークンの壁と、原因になる「クエリ対応型圧縮」を読み解く。

skill / verification
Skill2026.08.07

検証ループをSkillに埋め込む|公式パターンを自分の運用に当てはめる

Claude Code公式の検証ループパターンをFLOW運用のSkillに当てはめ、生成だけで検証が抜けている箇所を点検した記録。

model / benchmark
Context2026.08.06

"総合1位"の内側で3位|Opus 5のベンチマークを鵜呑みにしない

Opus 5はIntelligence Index総合1位だがSWE-bench Proでは3位。見出しの数字を鵜呑みにせず自分のハーネスで確かめる手順。

agmsg / cross-agent monitor
Deploy2026.08.05

Claude CodeとCodexを同時に見張る|クロスベンダーのagmsgを試した

複数のCLIエージェントを併用していると「固まった」のか「重い」のか判断できない。agmsgのSQLite越しmonitorモードで見分ける。

architecture / schema
Design2026.08.04

ルールを文章で書くのをやめた|人間とAIを同じスキーマで縛るアーキテクチャ設計

ドキュメントの「努力目標」を、AIも人間も逃れられないスキーマ構造に変えたZOZOTOWNの設計を読み解く。

quality / pr review
Quality2026.08.03

暗黙知をガイドライン化してAIに渡す|ドメイン特化PRレビューの作り方

暗黙知のレビュー観点をNG/OKペアに変え、投稿閾値でノイズを削るPR自動レビューの設計を読み解く。

quality / natural-language e2e
Quality2026.08.02

テストコードを書かずにE2Eテストする|Claude Code×Playwright CLIの自然言語テスト

テストコードを書かず、自然言語の手順のままAIにE2Eテストを実行させる仕組みを読み解く。

model / effort level
Context2026.08.01

モデル選択とエフォート設定は別物だった|Claude Code公式の使い分け指針

賢いモデルに変えても直らないミスがある。公式ブログが整理する『モデル』と『エフォート』という2つの別ダイヤル。

playwright / headless
Deploy2026.07.31

AIのブラウザツールがWebフォントを読まない時——OGP画像生成をPlaywrightに逃がした話

ブラウザプレビューがWebフォントを読まずCSPで詰んだ時、Playwrightヘッドレス直叩きに逃がした実録

security / web-fetch
Quality2026.07.30

「許可したURLしか踏めない」はずのClaudeから、どう秘密が漏れたか

URLの許可リストだけでは防げなかった漏洩手口。フェッチ後のページ内リンクという盲点から学ぶ設計。

skill / investigation runbook
Skill2026.07.29

調べ物を「動くマニュアル」にする|Claude Code Skillでリードタイムを7割減らした設計

複数ツール横断の調べ物をSkillで自動化し、リードタイムを7割減らした設計思想を読み解く。

measurement / effort
Quality2026.07.28

AIの工数削減、体感と実測はどれだけズレるか|1年間計測した結果

「俺が3人分」という体感と、実測0.58人月のズレ。1年間の工数計測から、AI活用の測り方を考える。

agent / harness
Design2026.07.27

同じモデルで22ポイント差|"ハーネス"がAIコーディングの成績を決める

Agent = Model + Harness。同じモデルでもハーネス次第でベンチマークが22ポイント動く実証データと、その恩恵の受け取り方。

compaction / verification
Quality2026.07.26

"止めたはずのプロセス"の出力が、なぜ"確認済み"として記憶されるのか

タイムアウトで強制終了したコマンドの出力が「確認済み」として記憶され、複数セッションに伝播する不具合パターンを読み解く。

autonomy levels
Context2026.07.25

そのタスク、AIにどこまで任せる?|"自律性レベル"を2軸で決める

自律性は1本の梯子ではない。「エージェンシー」と「オーケストレーション」の2軸で、任せる範囲を決める。

judgement / delegation
Prompt2026.07.24

指示を減らしたら、精度が上がった——Claude Codeチームが明かす「裁量」の効かせ方

「小さい変更はテストを省略していい」と細かく書くより、判断そのものを任せた方が結果が良かった、という逆説。

model / cost tiering
Context2026.07.23

AIのモデル使い分けで費用を下げる——「読む仕事」に高いモデルを使わない

探す・数える・集めるに高性能モデルを使わない。書く・直す・判断するだけに高いモデルを残す、3段の割り当てルール。

watchdog / cross-monitoring
Deploy2026.07.22

自動化は黙って死ぬ——AI同士に見張らせる番犬設計

週次レビューという自動化自体が止まったら、誰が気づくのか。月曜と木曜、別のAIに互いの生存を確認させる設計。

tts / voice conversion
Deploy2026.07.21

自分の声でAIナレーションを作る|VOICEVOX×RVCをローカルGPUで回す

テキストから自分の声のナレーションを作るVOICEVOX×RVCパイプラインを、8GB GPUで回した落とし穴と未解決課題。

harness / token overhead
Context2026.07.20

Claude Codeは会話を始める前に3万3000トークン消費している、という実測

会話を始める前にすでに数万トークン消費している、というハーネス固定費の実測レポートを読み解く。

delegation / prompt
Prompt2026.07.20

別のAIに仕事を渡すプロンプトの書き方|「ログの回収場所」を先に決める

別のAIセッションに作業を渡すとき、会話を読まなくても実行できる自己完結プロンプトの型。

closed test / recruiting
Deploy2026.07.20

Google Playの「12人14日」問題——クラウドワークスでテスターを集めた実録

Google Playのクローズドテスト、有料テスターは何日で何人集まるのか。募集文・表示の解釈・落とし穴を実録で。

tool schema / drift
Quality2026.07.20

モデルが賢くなるほど、ツール呼び出しは雑になる?|Opus 4.8で見つかった逆説

新しいモデルほど、独自スキーマにない項目を勝手に発明する。自前ツール定義を壊されないための設計。

bulk-edit / idempotent
Quality2026.07.19

公開中の記事44本を壊さず一括更新する|マーカーコメント+dry-runの型

公開済みの記事を何十本も手編集せず安全に一括更新する、マーカーコメント+冪等+dry-runの型。

verification / quality
Quality2026.07.18

AIの「できました」を信じない|3段階で検品する運用

AIエージェントに委任した一括作業を、ログだけで信じずgrepと本番HTTPアクセスで検品する3段階のプロセス。

multi-agent / handoff
Design2026.07.17

ClaudeとCodexを二人体制で運用する|引き継ぎ窓口はMarkdown1枚でいい

複数のAIエージェントで1つのプロジェクトを回すときの同期問題を、状態ファイルとは別の引き継ぎ専用Markdown1枚で解く設計。

context engineering / anthropic
Context2026.07.16

コンテキストは"有限のアテンション予算"だった|Anthropic公式が定義する設計原則

「コンテキストエンジニアリング」という言葉の公式な定義元を読み解く。有限のアテンション予算という考え方と、具体的な間引き手法。

cognitive offload / surrender
Design2026.07.15

それ、まだ"委任"?もう"降伏"?|AIに頼るときの境界線が動いていることに気づく

AIに委任してもオーナーシップを保てているか。「認知的オフロード」と「認知的降伏」を分ける境界線と、自己診断チェックリスト。

prompt injection / defense
Prompt2026.07.14

6,000回のハッキングに耐えて、漏洩0件だったAIアシスタントの守り方

メール経由のプロンプトインジェクション6,000回に耐え、シークレット漏洩0件だった実例から防御の考え方を学ぶ。

release review / claude fable
Quality2026.07.13

メジャーリリース前のセルフレビュー、AIに任せたら$149で何が見つかったか

OSSのメジャーリリース前レビューをClaude Fableに依頼した実例。$149.25で見つかった破壊的変更とは。

intent debt
Design2026.07.12

エージェントが絶対に肩代わりできない負債がある|"意図の負債"という盲点

技術的負債・認知的負債の先にある「意図の負債」。エージェントが肩代わりできない唯一の負債を、今日書き残す。

pdf / local tool
AI Tools2026.07.11

PDFをアップロードせず、同じ場所に毎回目隠しするHTMLツールを作った話

PDFをアップロードせず、定型位置の目隠し・注記をJSONテンプレートで再利用する無料HTMLツールを作った話。

loop engineering
Context2026.07.11

プロンプトじゃなく、ループを設計する|Claude Code公式とAddy Osmaniの共通解

Claude Code公式の4種のループ分類と、Addy Osmaniの5つの構成要素を突き合わせて実務の組み立て方を整理。

ai mini tools / compare
AI Tools2026.07.11

AI Mini Toolsは500円版と980円版のどちらを選ぶべきか

500円Starter Packと980円Replace Workbookの違い、買う順番、月3000円へ向けた導線を整理します。

context engineering
Prompt2026.07.10

「プロンプト設計」の時代は終わった|コンテキストエンジニアリングという次の勝負所

AIコーディングの争点は言葉選びから文脈管理へ。タスク分割・状態管理・文脈の間引きを具体例で整理。

claude code / permissions
Design2026.07.09

Claude Codeの権限モードが「Manual」既定に|地味だが事故を減らすアップデート

Manual既定の権限モードとAskUserQuestionの自動続行廃止。地味だが事故防止に効く変更点を整理。

diagram-sync / mermaid
Skill2026.07.08

大企業の自動化を、個人開発サイズに移植する|diagram-syncを作るときに考えたこと

ZOZOの構成図自動生成の仕組みを読み、個人開発サイズに何を削り何を残すかを考えて自作スキルにした記録。

claude code / artifacts
Context2026.07.08

Claude Codeの「Artifacts」、実務のどこで使えるか|PR説明・障害メモ・進捗ダッシュボードに落とし込む

セッションの作業をライブ更新のWebページ化。PR説明・障害対応メモ・進捗ダッシュボードでの使い方を整理。

claude code / steering
Skill2026.07.07

CLAUDE.md・スキル・フック・サブエージェント、結局どれをいつ使うのか|公式の判断基準を読み解く

CLAUDE.md/rules/skills/subagents/hooksなど7つの指示方法を公式の判断基準で整理。書き換え例つき。

ai mini tools / replace sample
AI Tools2026.07.07

無料Liteを自分用に差し替える手順|AIに渡す前の表とメモの整え方

AI Mini Toolsの無料Liteを、自分の表や問い合わせメモに差し替える前にやること。列名、架空データ、確認項目、AIへの渡し方を整理します。

ai mini tools / design
AI Tools2026.07.07

AIに業務ツールを作らせる前に決める3つのこと

ChatGPTなどに小さな業務ツールを作らせる前に、検索条件、分類ルール、確認責任を決めておく。3つのLite例から共通点を整理します。

sonnet 5 / 1m context
Context2026.07.07

1Mコンテキストに全部突っ込むといくらかかるのか、電卓を叩いた|Sonnet 5のコスト経済学

80万トークン常駐×10ターン=$16。でもキャッシュで$3.44、検索型なら$1。損益分岐を計算で出した

claude code / updates
Skill2026.07.06

Claude Code 6月末アップデート、実際に効くやつだけ拾った|/rewind・シェルモード・mcp login

/clear後に戻れる/rewind、出力に反応できるシェルモード、CLIで使えるmcp loginなど、Claude Codeの更新から日常の開発で効くものだけを整理します。

quote / checklist / ai workflow
AI Tools2026.07.04

AIに見積もりを書かせる前に、聞き漏れを減らすチェックツールを作る

見積もり文をAIに作らせる前に、問い合わせ内容の不足をチェックする。架空のWeb制作相談を題材に、聞き漏れを減らすミニツールを作ります。

inquiry / ai workflow / template
AI Tools2026.07.04

AIに返信文を書かせる前にやること|問い合わせメモを対応漏れしない一覧に変える

バラバラな問い合わせメモを、カテゴリ・期限・優先度・確認点・返信案に分解する。AIに返信文を書かせる前に、対応漏れを減らす一覧を作る実例です。

spreadsheet / html / ai tool
AI Tools2026.07.04

スプレッドシートを「検索できるミニ業務アプリ」に変える方法|AIで表をHTMLツール化する

Googleスプレッドシートをデータベースとして残し、HTML側で検索・カード表示・スマホ対応を整える。AIで表をミニ業務アプリに変える実例です。

gemini / codex / claude
AI Tools2026.07.01

Gemini 3.1 Pro、Claude Code、Codexをどう使い分けるか|課金する価値が出る境目

Gemini 3.1 Proで十分な作業と、Claude CodeやCodexに課金する価値が出る作業の境目を、静的レビュー・実行検証・継続ファイル管理の3軸で整理します。

revenuecat / store status
Deploy2026.06.22

RevenueCat「illegal parameters service_account_key_details」を直す|Google Play連携

RevenueCatのillegal parameters service_account_key_details、Could not checkを解決するGoogle Play連携手順。必要な3 API、Cloud/Play Console権限、JSON、Offering、実機テストを2026年8月の公式手順で再確認。

skill / tokens
Skill2026.06.21

自作スキルは「適切なトークン量」に設計されていない——その理由と直し方

成果物を変えずにスキルのトークン消費を減らす。常時コストと二度読みを、4つのレバーで設計し直す。

skill / launch-assets
Skill2026.06.18

アプリのリリース素材5点を、AIに「一気通貫」で出荷させる手法

アイコン・LP・グラフィック・ストア文章・ポリシー。アイコンで決めた一色を下流すべてに流し込み、5点を同じブランドで一気に。

このカテゴリの記事はまだありません。
▶ 実装リソース

公開できる手順とコードは、GitHubに置いています。

記事で紹介しているSKILL.md本体や関連する実装メモは、確認できる形で公開しています。

公開中のSKILL.mdを見る →