講演情報

[A-10-05]テーブルデータ生成における未学習データの分布再現性の検証

〇池田 直樹1、大矢 友貴1、黒川 茂莉1 (1. 株式会社KDDI総合研究所)

キーワード:

拡散モデル、テーブルデータ生成、条件付き生成

プライバシー保護やデータ拡張を目的としたテーブルデータ生成において,分布再現性能が高い技術として,拡散モデルが注目されている.大矢ら[1] は特定のカラムを条件にデータ生成可能な条件付き生成のフレームワークを提案した.複数の条件設定によって未学習のデータを生成可能であるが,その性能に関しては明らかになっていない.そこで本稿では,当条件付き生成モデルの未学習条件に対する合成データの生成性能を定量的に評価する.