AIコーディング実測

9 本の記事。

無料AIコーディングのおすすめ選びより先に、何が渡っているかを測る

macOS 26.6.1 · arm64 · 検証コマンド 23 本 · 2026-09-17

repo map の既定予算はモデル依存。同じリポジトリで6ファイルと43ファイルに分かれた

AIコーディングの無料おすすめ記事は出力しか見ていない。aider の repo map を APIキーなしで実測したら、予算の既定値はモデルによって1024と4096に分かれた。同じリポジトリでも、モデル名を変えるだけで渡る量が6ファイルと43ファイルに変わる。

Claude Code の設定ファイルの場所は、起動したディレクトリで変わる

macOS 26.6.1 · arm64 · 検証コマンド 9 本 · 2026-09-17

壊した設定を doctor に名指しさせ起動位置ごとに読まれる場所を特定

Claude Code の設定ファイルの場所を、わざと壊して claude doctor に名指しさせる方法で実測した。リポジトリルートに commit した .claude/settings.json は、サブディレクトリから起動すると読まれない。

Claude Code の使い方、初心者が貼る deny は読まれない

macOS 26.6.1 · arm64 · 検証コマンド 18 本 · 2026-09-15

allow/ask/deny の8通りの書き方を起動時警告で判定し検査器と突合

Claude Code の使い方を調べて最初に貼る settings.json の deny ルールは、書き方しだいで権限チェックから一度も参照されない。初心者向け記事によくある形をそのまま読ませて測り、無効なルールを洗い出すチェッカーを作った。

Claude Code のフックが黙って効かなくなる3経路を実測した

macOS 26.6.1 · 検証コマンド 24 本 · 2026-09-02

フックが拒否を返さなくなる3経路をexit codeで再現

Claude Code の規律をフックに降ろしても、判定の手前で開くことがある。grep への依存、stdin を cat で読むこと、変数展開の3経路で PreToolUse が拒否を返さなくなることを、フック単体に JSON を流して exit code で確かめた。

AIエージェントの中身はwhileループ ── 自作して壊れ方まで実測した

macOS 26.6.1 · 検証コマンド 12 本 · 2026-08-17

フレームワーク無しの while ループ型エージェントを自作し、壊れ方を実ログで確認した

AIエージェントの中身を理解するため、フレームワークなしで ollama のローカルLLMと Python 標準ライブラリ120行のループを自作した。tool_calls が返らない、小型モデルが無限ループするなど、実際に踏んだ壊れ方を実ログ付きで示す。

生成AI開発の最初の壁「JSONで返して」を無料のローカルLLMで実測する

macOS 26.6.1 · 検証コマンド 4 本 · 2026-08-17

prompt 指示だけでは3モデルとも厳密パース 0/5。schema 指定で 5/5 に

生成AIアプリ開発で最初に詰まる「LLM出力をJSONで受け取る」を、ollamaのローカル小型モデル3種×structured outputsあり/なしの30リクエストで実測した。プロンプト指示だけでは7Bでも厳密パースが通らない。

Claude Code実践入門の次、claude -p の落とし穴を実測する

macOS 26.6.1 · 検証コマンド 16 本 · 2026-08-17

claude -p は権限拒否で何も作られなくても exit 0 を返すことを実ログで確認

『Claude Code実践入門』を読み終えて claude -p をスクリプトに組み込むと、権限拒否で何も作られなくても exit 0 が返る。この挙動と --allowedTools の引数順の罠、JSON出力のパースを実行ログ付きで示す。

AIコーディング比較は読むより測る——ローカルLLM3種をpytestで採点した

macOS 26.6.1 · arm64 · 検証コマンド 13 本 · 2026-08-17

同一6問を pytest で採点。7b が 5/6、1.5b が 4/6、deepseek 1.3b は 1/6

AIコーディングツールの比較記事は料金表とベンチ引用ばかりで、自分のタスクでの実力が分からない。同一プロンプト・pytest自動採点のハーネスを自作し、無料のローカルLLM3モデルの合格率と落ちたコードを実測した。

AIコーディングのおすすめ構成を無料で組んで実測した

macOS 26.6.1 · 検証コマンド 21 本 · 2026-08-17

Ollama + qwen2.5-coder:7b + aider が3つのバグを全部直し、1.5b は1つ見逃した

AIコーディングのおすすめ記事に実測はない。完全無料でそろうOllama×Qwen2.5-Coder×aiderにバグ入りコードを渡し、テストが通るまで直せるかをモデルサイズ別に検証した記録。