
WebMCPとは?llms.txt・リモートMCPとの違いを自分のサービスで実験した
WebMCPとllms.txt・リモートMCPの役割の違いを整理します。自分の家計簿サービスでMCPを切断して生JSでのデータ取得を試し、Chromeのフラグを有効化してWebMCPツールを実行するまでの検証手順と、「データはMCP、画面の介助はWebMCP」という役割分担の判断軸をまとめます。
Exploring the intersection of AI, design, and technology. Deep dives into innovation that shapes the future.

WebMCPとllms.txt・リモートMCPの役割の違いを整理します。自分の家計簿サービスでMCPを切断して生JSでのデータ取得を試し、Chromeのフラグを有効化してWebMCPツールを実行するまでの検証手順と、「データはMCP、画面の介助はWebMCP」という役割分担の判断軸をまとめます。

CLAUDE.mdに何を書き、何を書かないべきかを実運用の構成で解説します。CLAUDE.mdを1行にしてAGENTS.mdへ1本化する理由、複数エージェントで指示書のドリフトを止める設計、守らせたいルールをhooksへ逃がす使い分けまでを記録します。

Codexなど CLIエージェント主体の開発でZedとVS Codeを本気で比較した記録。ZedのACP統合とサブスク対応の非対称を調べた末に、エディタの役割が「たまにコードを読むビューア」へ縮む過程と、差分レビューをPRに寄せるとエディタ選定が「好みの問題」になる判断フレームをまとめます。

AIエージェントに投稿ツールを渡すと放っておくと公開し過ぎます。その制限をプロンプトではなく自作MCPサーバー側(Cloudflare WorkersのKV)に置いた実装記録。単純なカウントではなくreserve→commit/releaseの二段階にした理由と、失敗時に枠を戻す設計まで解説します。



AIエージェントにSNS投稿を任せると、怖いのは投稿しないことではなく二重に投稿することです。行ロックが使えないNotionの投稿キューで、status遷移と「claim→直後再読」の楽観的排他、15分staleルール、あえて自動リトライしない設計をどう組んだか、実運用中の構成をそのまま解説します。


SQLiteの「書き込みが同時1本に直列化される」制約が本番でどう効くかを解説します。ロックの正体と待ち時間の実感値、ECを例にした思考実験、唯一の事故パターンである長いトランザクション、在庫競合がむしろ単純になる理由、採用判断の目安までを整理します。

AIエージェントに公開作業を任せるときのチェック機構を「決定的に落とす層」と「LLMに判断させる層」の2層に分けて運用している実装記録。GitHubがalt textチェックで公開した同じ層分けの設計と突き合わせ、誤検知で審査が信用を失わないための逃げ道の作り方、PASSを床として扱う考え方をまとめます。


Claude Codeのサブエージェントで、公開前レビューを執筆エージェントから分離した実装記録。読み取り専用のcritic定義、判定基準のファイル固定、PASS/FAILの機械判定、修正2回上限と隔離まで、実際に運用している構成を解説します。