ブログ

Blog

ローカルLLM検証と、ComfyUI動画制作の現場ノート。

推論エンジンや量子化などの評価前段から、性能・品質の測り方、ComfyUI学習まで。週3本(月・水・金に各1本)でシナリオ順に公開しています。

用語集(run_id / dry-run など)

Series

連載をシナリオ順に読む

AI

測ってから選ぶ、ローカルLLM運用

社内検証基盤をもとに、評価前段(推論エンジン地図: vLLM/TRT-LLM/SGLang/Atlas・量子化・投機・性能/品質)から運用比較まで、シナリオ順に公開します。

記事を見る

Latest

新着記事

Gemma
AI 公開日 初級

vLLM起動プロファイルを読む:Gemma4を例に

vLLMの起動プロファイル(YAML)の読み方を、Gemma4系のcoding-agent例で具体化します。モデル前提・ポート・メモリ枠・パーサの見方を整理します。

メトリフクロウ
メトリフクロウ 検証ラボ / Evaluation Lead
測ってから選ぶ、ローカルLLM運用
Docker × vLLM
AI 公開日 初級

dry-run 文化で壊さないローカルLLM起動

ローカルLLM運用では、実起動の前に生成される構成を確認する dry-run が安全弁になります。設計上の builder / executor 分離も合わせて解説します。

クムビーバー
クムビーバー 現場実装 / Platform Engineer
測ってから選ぶ、ローカルLLM運用
Docker
AI 公開日 初級

run_id で残す、再現可能な検証の型

ローカルLLM検証でいちばん大切なのは結果の数字より、条件と結果を後から比較できる記録の型です。

クムビーバー
クムビーバー 現場実装 / Platform Engineer
測ってから選ぶ、ローカルLLM運用
Lab Notes
AI 公開日 初級

ローカルLLM検証を公開する理由

モデル名の流行ではなく、再現可能な評価の型を公開する意図と、読者が最初に押さえるべき視点を整理します。

ワケハト
ワケハト 事業翻訳 / Solution Strategist
測ってから選ぶ、ローカルLLM運用

AI Series

測ってから選ぶ、ローカルLLM運用

社内検証基盤をもとに、評価前段(推論エンジン地図: vLLM/TRT-LLM/SGLang/Atlas・量子化・投機・性能/品質)から運用比較まで、シナリオ順に公開します。

  1. 01
    ローカルLLM検証を公開する理由

    公開日

    モデル名の流行ではなく、再現可能な評価の型を公開する意図と、読者が最初に押さえるべき視点を整理します。

  2. 02
    run_id で残す、再現可能な検証の型

    公開日

    ローカルLLM検証でいちばん大切なのは結果の数字より、条件と結果を後から比較できる記録の型です。

  3. 03
    dry-run 文化で壊さないローカルLLM起動

    公開日

    ローカルLLM運用では、実起動の前に生成される構成を確認する dry-run が安全弁になります。設計上の builder / executor 分離も合わせて解説します。

  4. 04
    vLLM起動プロファイルを読む:Gemma4を例に

    公開日

    vLLMの起動プロファイル(YAML)の読み方を、Gemma4系のcoding-agent例で具体化します。モデル前提・ポート・メモリ枠・パーサの見方を整理します。

  5. 05
    性能と品質の二軸でローカルLLMを評価する

    公開日

    throughputだけでは決めない。定量性能とタスク品質を同じrunに残す評価設計を解説します。

  6. 06
    latencyだけ見ない:concurrencyとthroughputの測り方

    公開日

    常駐マルチユーザ前提で、同時実行とスループットをどう測り、どう読むかを整理します。

  7. 07
    数値が嘘をつくとき:ハーネス確認と実機計測の差

    公開日

    開発機のモック計測と実機GPU計測を混同しないための読み方と、公開時のガードレールを解説します。

Contact

観光DX・ローカルLLMの課題感があればご相談ください。