effort

ローカルLLM実装

Gemma 4をRTX 4070(12GB)で実測|12B・E4B・Qwen3 14B・Phi-4-mini・26Bを同じ試験でクラウドと比べた

RTX 4070(12GB)でGemma 4・E4B・Qwen3 14B・Phi-4-mini・26Bの5モデルをOllamaで実測。クラウドのOpus 4.8と同一テストで採点し、12GB級はコード15/15で同点。速度・VRAM・画像認識の差を実数値で比較した。
AIコーディング

Claude Opus 4.8のeffortを実測検証|全5段階×Code/Cowork/Chatでトークン・速度・品質はどう変わるか

Claude Opus 4.8のeffort(low〜max+ultracode)を実機で27run検証。出力トークンは約7倍、処理時間は最大6倍に増える一方、正解率は全レベル同じ。実測データと使い分け指針を公開。
AIコーディング

Claude Code のステータスラインを自作する|プラン・effort・応答時間・使用量ゲージを1行に

Claude Codeのステータスラインを Node.js で自作する実装記録。stdinに渡るJSONスキーマ、契約プラン・effort・応答1回ごとのAPI処理時間(累積値の差分方式)・公式使用量ゲージ(rate_limits)の実装と設計判断、Windowsのハマりどころまでまとめました。