Upgrade to Pro — share decks privately, control downloads, hide ads and more …

AIは『対話』の時代から『自律(Agentic)』の時代へ

 AIは『対話』の時代から『自律(Agentic)』の時代へ

ChatGPTなどのSaaS型LLMの枠を超え、いよいよ「Agentic AI(自律型AI)」が現場のスタンダードになりつつあります。本セミナーでは、単なるチャットツールとしての活用ではなく、ClineやOpenCodeといった強力なエージェントを駆使し、開発プロセスを自動化・高速化するソリューションを紹介します。 また、コストやプライバシーの制約を突破するためのローカルLLM(Ollama, LM Studio等)の構築術から、Qwen/Gemma等の最新モデル選定、さらには実機でのコード生成の実演まで、明日から使える「現場主義」のAI活用術を徹底解説します。

なお、内容は初心者向けを想定しています。

Avatar for とことんDevOps

とことんDevOps

July 22, 2026

More Decks by とことんDevOps

Other Decks in Technology

Transcript

  1. 会社の紹介 • 社名:日本仮想化技術株式会社 (VirtualTech Japan Inc.) • 設立:2006年12月 / 資本金:3,000万円

    • 本社:東京都渋谷区渋谷1-8-1 • URL:http://VirtualTech.jp/ • 仮想化技術に関する研究、開発、各種調査、システムの構築等 • OpenStackやKubernetes、OpenShift、DevOps基盤の導入支援・新 規機能開発、ブログ等での積極的な情報発信 • GPUを活用した生成AI技術の研究、DB高速化技術等 2
  2. LLMからAIエージェントへ • 少し前までは、AIに「チャットで質問して答えをもらう」使い方が中心 • 生成AIの進化により、文章作成やコード生成などの作業支援が可能になった • 現在は第3世代(LLM)から第4世代(Agentic AI)への移行期にある 世代 主な技術

    代表例 1 ルールベースAI エキスパートシステム 2 機械学習AI Deep Learning、画像認識、音声認識 3 Foundation Model/LLM ChatGPT、Claude、Gemini 4 Agentic AI Deep Research、各種AIエージェント 6
  3. SaaSのLLM • 代表的なもの ◦ OpenAI ChatGPT / Codex ◦ Anthropic

    Claude / Claude Code ◦ Google Gemini • これらはクラウド上で動くため、高性能なモデルを手軽に使える • 最新機能や性能の高いモデルをすぐ使えるのが強み • 利用料金やデータの扱いは意識する必要あり 9
  4. ローカルLLM • ローカルLLMは、自分のローカルマシンやサーバーで動かすLLM • 代表的な実行環境として LM Studio, Ollama, llama.cpp, vLLM

    • インターネット接続依存せず、自環境で完結して使えるのが特徴 • モデル選定や環境構築は必要だが、使い方がはまると非常に便利 • SaaS LLMを補うものであって、代替にはならないと言う認識が必要 10
  5. LLMの比較 項目 SaaS LLM ローカルLLM 導入 すぐ使える 構築が必要 性能 高性能モデルを使いやすい

    環境に左右 コスト 継続課金になりやすい 初期費用のみ データ 外部送信あり 手元で完結 軽作業 やや贅沢 気軽に回せる 重作業 対応可能 厳しい場合も 用途 校正・変換・たたき台 調査・設計・レビュー → 用途に応じて使い分ける・組み合せるのが現実的 11
  6. ローカルLLMのツール 初めての利用ではLM StudioまたはOllamaをおすすめ 種類 概要 LM Studio GUIが使いやすいツール。モデルをGUIして検索で利用。基本機能は CLIも利用可能 Ollama

    シンプルなツール。シンプルなチャットUI、基本はDockerのような CLI操作。なぜか海外スレでは評判が悪い。Ollama Cloudが便利 llama.cpp 上の二つのバックエンドで利用。ビルドして直接使える。基本的にコ ア部分しかない。クライアントおよびサーバーとして利用可能 vLLM LLMサーバーとして使う場合の候補。並列実行に強い AnythingLLM ローカルLLMにネット検索、RAG、モデルルーティング機能等を追加 12
  7. AIエージェントとは いろいろな機能のAIエージェントがあります。 OpenClawとかHermes Agentは今、話題ですよね。 分類 何をしてくれる? 代表的なもの 開発を支援するAI エージェント コーディング、テスト、

    リファクタリング Codex、Claude Code、 OpenCode、Goose、Cline 仕事を支援するAI エージェント RAG、文書作成、情報整 理、メール、予定管理 AnythingLLM、OpenClaw、 NemoClaw、Dify 複雑な作業を自動化 するAIエージェント 複数のツールを組み合わ せてタスクを実行 OpenHands、Hermes Agent 13
  8. 開発を支援するAIエージェントの使い分け 開発支援AIツールは大きくわけて4つ 分類 概要 代表的なもの 自動補完型 コード入力中に次のコードや関数を GitHub Copilot 提案し、実装を支援

    対話型 自然言語による対話を通じて設計・ GitHub Copilot, ChatGPT, Claude, 実装・調査を支援 Gemini IDE統合エー ジェント型 IDEと連携し、ファイル編集やコマ GitHub Copilot, Cursor, Codex, ンド実行を含む複数工程を自律的に Continue, Cline 実行 エージェン ト型 ファイル編集・コマンド実行・Git 操作などを自律的に実行。CLIで操 作 GitHub Copilot, Codex, Claude Code, OpenCode, Goose, Continue, Cline 14
  9. 生成AIとセキュリティ • 「生成AIが生成するコードは安全であるとは限らない」という認識は必要 ◦ 人間が書いたコードも生成AIが生成したコードも一緒 ◦ 今日安全だったコードが明日も安全とは限らない ▪ モジュール、ライブラリーに対するサプライチェーン攻撃対策も必要 ▪

    最近Node npm, Python pipが頻繁に狙われている • セキュリティーに対応するためにDevSecOps ◦ 開発の初期段階からCI/CDを組み込む ◦ セキュリティーテストとコードレビューの自動化 ◦ 運用中のソフトウェアの継続的なモニタリング 16
  10. ローカルLLMを使い物にするテクニック(1) • サーバー側を調整する ◦ コンテキスト長を適切に設定 ◦ KVキャッシュの余裕を意識 ◦ 量子化は軽さと品質のバランスで選ぶ ▪

    メモリー消費量を取るか、品質重視するかで選択 • 適切なモデルを選ぶ ◦ チャット用とコーディング用は分ける ◦ コーディングでは見かけの性能よりToolsを安定して扱えるモデルを選ぶ 20
  11. ローカルLLMを使い物にするテクニック(4) • GPU ◦ 大きいモデルを快適に動かすには大容量のGPUメモリーが必要 ◦ LLMモデルとキャッシュなどがGPUに載る ◦ 複数GPUもサポートしているソフトウェアもある •

    Mac ◦ MLXを選ぶと速い ▪ Appleシリコン(M1以降)対応 ▪ Metalを使って推論が高速 ◦ GGUFだと正常に動くが、MLXでは問題発生することがまれにあるので注意 23
  12. ローカルLLMを使い物にするテクニック(5) • GGUF ◦ 色々な量子化の種類があるが、基準はQ4_K_M ◦ これより小さいモデルは使うべきではない • MLX ◦

    基準は4ビットのモデルで良い ◦ nvfp4は攻めた量子化なので、Vison向けに使う時は要注意 ▪ 画像分析の品質の劣化が目立つ 24
  13. ローカルLLMとコーディング • ローカルLLMのモデルはチャット用途とコーディング用途で、向き 不向きがある • エージェント利用でなければ、どのモデルでも良い • エージェント利用の場合は、Toolsの扱いが安定しているモデルを 選ぶのが重要 •

    英語圏では評価が高いモデルも日本語で使うと著しくコード品質が 落ちる傾向も ◦ Qwythos 9B V2は英語プロンプトではThinkingと最終結果がほぼ 一致、日本語では90点から30-40点の品質まで低下 29
  14. おすすめローカルLLMモデル GPT-OSS 20B • おそらくローカルLLMを試す時に最初に動かすモデル • 16GBメモリーを実装したGPUがあればスムーズに動く (61.72token/s) ◦ NVIDIA

    RTX2000 Adaで動作を確認 • ある程度の環境で動かせば、コード生成は爆速 • Toolsの利用もOpenCodeでは安定動作を手元で確認 30
  15. おすすめローカルLLMモデル Gemma4 12B QAT • Gemma4 26Bよりは劣るが、コーディングにも十分役立つ • 最近でたので試したら、意外と良かった •

    頑張ればローカルでも動くレベルのモデル • 社内でllama.cppを使ってコンテキスト長262Kまで受け入れる設定 • ある程度の環境で動かせば、コード生成は爆速 • Toolsの利用も比較的に安定 32
  16. おすすめローカルLLMモデル Ornith-1.0 9B • 2026/6/25登場の最新モデル • 397B, 35B, 9Bがオープンソースライセンスで公開 •

    エージェント型コーディングに特化 • Toolsの利用も安定 • たまに長考する場合も 33
  17. Codex CLIの設定例 • Codex CLIをインストール • 以下Ollamaの場合。LM Studioの場合はプロバイダー名を lmstudio と書く

    //このような設定を書く $ cat ~/.codex/ollama_gemma4.config.toml oss_provider = "ollama" model_provider = "ollama" model = "gemma4:12b-it-qat" //プロファイル指定で起動 $ codex --profile ollama_gemma4 43
  18. OpenCodeの設定例(1) • たとえばOllamaを起動 • 次に、APIで見えるモデルIDを確認 curl -s http://127.0.0.1:11434/v1/models | jq

    • ~/.config/opencode/opencode.jsonc に設定を書く • 他のLLMサーバーでも、設定の書き方はだいたい同じ ◦ Ollama: 11434 / LM Studio: 1234 46
  19. OpenCodeの設定例(2) { } "$schema": "https://opencode.ai/config.json", "permission": { "edit": "allow", "bash":

    "allow", "read": "allow" }, "provider": { "ollama": { "npm": "@ai-sdk/openai-compatible", "name": "Ollama", "options": { "baseURL": "http://127.0.0.1:11434/v1" }, "models": { "ornith:9b": { "name": "Ornith 9B", "tools": true, "limit": { "context": 16384, "output": 4096 } } } } }, "model": "ollama/ornith:9b" 47
  20. おまけ AIサブスク 月額 Google AI Plus 725円 (400 GB のストレージ)

    ChatGPT Plus 3000円 OpenCode Go 10ドル (1500円) 合計 月5,225円 • GitHub Copilot Proは最近解約 • 1ドル150円換算 55
  21. 参考文献 • 服部 佑樹 氏著「技術評論社 コードxAI ソフトウェア開発者のため の生成AI実践入門」 • 2027年までに、エージェント型コーディングを利用するエンジニ

    アリングチームの65%超が、統合開発環境(IDE)を「必要不可 欠」と考えなくなると予測、自動化プラットフォームに移行へ • Loop Engineering • Gemma4 テンプレートの修正パッチ • OpenCode • Cline 56