第2回:自然言語→SQL エージェントで KOI を測る ― 品質を守りながら費用対効果の高いモデルを選ぶ
自然言語で聞くと AI が SQL を生成して社内データベースに問い合わせる Text-to-SQL エージェントを題材に、5 つのモデルを KOI(KPI ÷ コスト)で実測しました。品質フロアを設けたうえで、最も費用対効果の高いモデルを選ぶ過程を、実測値と手順とともに紹介します。
読む →
「AI Agent」タグの記事(7件)
自然言語で聞くと AI が SQL を生成して社内データベースに問い合わせる Text-to-SQL エージェントを題材に、5 つのモデルを KOI(KPI ÷ コスト)で実測しました。品質フロアを設けたうえで、最も費用対効果の高いモデルを選ぶ過程を、実測値と手順とともに紹介します。
OpenClawのデフォルト構成(Gemini 3 Flash)にPythonのルールチェックコードを書かせたところ、25回の書き直しを経て正解値をハードコードする結果になりました。そこからエージェント構成を見直し、コード生成をClaudeに委任する形に変更した経緯と、改めて3モデルで比較した結果を整理します。
OpenClawをクラウドサーバーで運用した初日に、APIコストが想定の5〜10倍に膨らみました。原因の切り分けと、そこから導き出した3Tierモデル戦略をまとめます。
OpenClawのheartbeatが深夜に暴走し、2時間36分で1.29ドルを消費したインシデントの記録です。「空」の指示が暴走を招く理由と、フィードバックループを避けるための設計指針をまとめます。
複数のAIエージェントが互いに監視・補完・交渉する時代の到来と、その背景にあるGAN的な発想について考察します。
OpenClaw熱という社会現象を背景に、Alibaba・Tencent・ByteDanceがそれぞれ違う形で「AIをお金にする」方法を競う中国AI市場の現在地を読み解く。
WeChatという生活インフラの上にAIエージェントを載せようとするTencentの動きと、OpenAIが実用化で苦戦する構造的理由を考察します。