Workshop

AI Agent評価体系構築セミナー:座学からハンズオン

Event Overview
近年、生成AIやAIエージェントを活用したアプリケーションが急速に実用化される一方で、「どのように品質を担保するのか」という課題に向き合う企業が急速に増えています。実際に、AIアプリケーションの開発・運用において、評価手法や品質保証に関するお問い合わせやご相談も年々増加しています。

こうした背景の中、書籍『生成AIアプリケーション評価入門』は、多くの開発者・品質保証担当者から支持を集めています。本勉強会では、同書の著者である株式会社ベリサーブ 松木氏と株式会社ジェネラティブエージェンツ 西見 公宏氏をお迎えし、生成AIアプリケーションの品質保証をどのような観点で考えるべきかを解説いただきます。

さらに、品質を考え方として学ぶだけではなく、実際に開発・運用へ落とし込むことも重要です。本勉強会では、Weights & BiasesのWeaveを用いたハンズオンを通じて、オフライン評価・オンライン評価を組み合わせた実践的な評価プロセスを体験していただきます。こちらのハンズオンは株式会社ジェネラティブエージェンツとWeights & Biases の共同開発です。

「なぜ評価が必要なのか」という考え方から、「どのような観点で評価するのか」、そして「実際にどのように運用へ組み込むのか」までを、講義とハンズオンを通して一気通貫で学べる3時間の勉強会です。生成AI・AIエージェントの品質保証に関心のある開発者、プロダクトマネージャー、AI活用を推進する皆さまのご参加をお待ちしております。
開催概要

開催日時
2026年9月10日(木)15:00〜18:00

開催形式
オフライン開催(抽選制)
→ 抽選結果(現地参加可否)につきましては、9月4日(金)に、ご登録のメールアドレス宛にご案内いたします。

場所 :東京都千代田区神田神保町3-23-2 神保町錦明ビル5階

・株式会社ベリサーブ、株式会社ジェネラティブエージェンツ、Weights & Biases 共同開催

対象者
  • 生成AIアプリケーション開発を進められているエンジニア・マネージャー
スピーカー

松木 晋祐 氏
株式会社ベリサーブ 執行役員 研究開発管掌 / AIQVE ONE株式会社 取締役CTO

独立系ソフトウェアベンダにて、テストオペレータから品質部門統括まで、ソフトウェアテストと品質保証にまつわるさまざまなロールを経験後、株式会社ベリサーブ/AIQVE ONE株式会社へ。
AIxQA分野において国内のさまざまな企業、産業に向けた品質技術、製品開発、提案、コンサルティングを行なっている。

社外活動に、東京電機大学CySec講師、テスト自動化研究会ファウンダー、ISO/IEC JTC1/SC7/WG26、JSTQB Technical Committee、W3C CSSWG コントリビューターなど。
著書(共著/共訳)に『生成AIアプリケーション評価入門』(技術評論社, 2026)『Androidアプリ テスト技法』(秀和システム,2013)、『システムテスト自動化 標準ガイド』(翔泳社,2014)など。

 

西見 公宏 氏(Xアカウント
株式会社ジェネラティブエージェンツ 代表取締役CEO

2024年3月、AIエージェントの開発・利活用を専門に扱う同社を創業。法人を中心にAIエージェントの活用支援・開発支援を行っている。LangChain公式アンバサダー。著書に「その仕事、AIエージェントがやっておきました。」「LangChainとLangGraphによるRAG・AIエージェント[実践]入門」(共著)「実践Claude Code入門」(共著)「現場で活用するためのAIエージェント実践入門」(共著)。Software Design誌「実践LLMアプリケーション開発」連載。

 

大嶋 勇樹 氏
株式会社ジェネラティブエージェンツ 取締役CTO

株式会社ジェネラティブエージェンツ取締役CTO/Co-founder。大規模言語モデルを組み込んだアプリケーションやAIエージェントの開発を実施。個人ではエンジニア向けの勉強会開催や教材作成など。オンラインコースUdemyではベストセラー講座多数。勉強会コミュニティStudyCo運営。共著書「ChatGPT/LangChainによるチャットシステム構築[実践]入門」「LangChainとLangGraphによるRAG・AIエージェント[実践]入門」。

 

鎌田 啓輔(Xアカウント
Weights & Biases Japan
Senior Manager of Account Solutions Architecture

因果推論からML、LLMまで行う機械学習エンジニア。APTではビジネス施策における因果推論の支援、DataRobotではヘルスケアチームのLead Data Scientistとしてヘルスケア業界を中心に数十社のAI導入を支援。コロナ禍には国立国際医療研究センターと論文や厚生労働省へのレターを作成。Weights & Biasesでは、企業へのMLOps構築支援やLLMリーダーボードの開発、GENIACプロジェクトでのGPU利用管理体系構築などを行なっている。

Agenda

15:00-15:30
オープニング・AIエージェント開発のリアル
株式会社ジェネラティブエージェンツ 西見 公宏 氏
15:30-16:00
基盤モデル・AIエージェントの品質保証と評価
〜オフライン評価・オンライン評価によるフライホイール〜

株式会社ベリサーブ 松木 晋祐 氏
16:00-16:05
休憩
16:05-17:45
AIエージェント評価プラットフォームを活用したハンズオン
〜オフライン評価・オンライン評価を実践してみよう〜

株式会社ジェネラティブエージェンツ 大嶋 勇樹 氏 + Weights & Biases 鎌田 啓輔
17:45-18:05
質疑応答・クロージング
登壇者一同

Featured
speakers

松木
晋祐
株式会社ベリサーブ 執行役員 研究開発管掌
AIQVE ONE株式会社 取締役CTO
西見
公宏
株式会社ジェネラティブエージェンツ
代表取締役CEO
大嶋
勇樹
株式会社ジェネラティブエージェンツ
取締役CTO
鎌田
啓輔
Weights & Biases
Senior Manager of Account Solutions Architecture