セッション詳細
[2K6-GS-7d]画像音声メディア処理:視覚言語理解とマルチモーダル生成
2026年6月9日(火) 17:30 〜 18:45
K会場(中会議室201A)
座長:佐々木 翔大(SB Intuitions株式会社)
[2K6-GS-7d-01]顔認知特性に基づく肌色知覚の定量化に向けた視覚数理モデルの開発
〇西村 綾莉1、末松 健1、笹木 亮1、中村 理恵1、富山 遥2、伊藤 貴之2 (1. 株式会社コーセー、2. お茶の水女子大学)
[2K6-GS-7d-02]対話における心情理解に向けたメタ対話データセットの構築と予備的分析
下西 慶1、〇井上 昂治1、臼田 泰如2、坂井田 瑠衣3 (1. 京都大学、2. 静岡理工科大学、3. 公立はこだて未来大学)
[2K6-GS-7d-03]視覚言語モデルにおける視覚アクセス境界の存在の実証
〇大坂 洋豊1、谷口 尚平1、峰岸 剛基1、山下 佳威1、鈴木 雅大1、松尾 豊1 (1. 東京大学)
[2K6-GS-7d-04]FasTARFlow:Transformerベース自己回帰フローから高速な逆自己回帰モデルへの蒸留
〇山下 佳威1、谷口 尚平1、鈴木 雅大1、松尾 豊1 (1. 東京大学)
[2K6-GS-7d-05]スケジューリング可変な周波数逐次自己回帰型画像生成モデル
〇三宅 大貴1、鈴木 雅大1、松尾 豊1 (1. 東京大学)
