実測ノート
Ollama などのローカル LLM で詰まった症状を、実測で切り分けて直す
実測ノート
Ollama などのローカル LLM で詰まった症状を、実測で切り分けて直す
誰のため
ローカル LLM(Ollama など)を自分の PC で動かし、構造化出力や自動化で詰まっている開発者
何を検証
手元の PC(RTX 5070 Ti 16GB、Ollama、qwen3.5 / gemma3)で実際に再現し、数値と手順を載せています。確かめていないことは「未検証」と書きます。
JSON・構造化出力が壊れる
Ollama で JSON が途中で切れる:num_ctx 4096 の天井を見分けて直す
分かること:
done_reason が length で、入力+出力がちょうど 4,096 なら文脈長の天井。/v1 では num_ctx が効かない
対象:構造化出力が長い入力のときだけ壊れる人
更新 2026-09-23
Ollama の JSON スキーマで省略可のフィールドが出てこない:required と nullable で直す
分かること:
required でないキーは出力から丸ごと消えうる。安全に関わる項目は required+nullable に
対象:pydantic のモデルで Ollama の構造化出力を使っている人
更新 2026-09-22
LLM に審査・判定をさせたい
LLM に「捏造の判定」を任せると正直な開示まで落とす:合否はコードで照合する
分かること:
審査役の LLM は否定文や開示を捏造と誤判定した。最終判定は許可された事実一覧との照合に
対象:LLM にレビュー・判定をさせる自動化を作っている人
更新 2026-09-23