Session Details

[2K6-GS-7d]Vision, speech media processing

Tue. Jun 9, 2026 5:30 PM - 6:45 PM JST
Tue. Jun 9, 2026 8:30 AM - 9:45 AM UTC
Room K(Middle room 201A)
座長:佐々木 翔大(SB Intuitions株式会社)

[2K6-GS-7d-01]Development of a Visual Mathematical Model for Quantifying Skin Tone Perception Based on Facial Recognition Characteristics

〇Ayari Nishimura1, Ken Suematsu1, Ryo Sasaki1, Rie Nakamura1, Haruka Tomiyama2, Takayuki Itoh2 (1. KOSÉ Corporation, 2. Ochanomizu University)

[2K6-GS-7d-02]Construction of a Meta-dialogue Dataset and Preliminary Analysis for Understanding Psychosentience in Dialogue

Kei Shimonishi1, 〇Koji Inoue1, Yasuyuki Usuda2, Rui Sakaida3 (1. Kyoto University, 2. Shizuoka Institute of Science and Technology, 3. Future University Hakodate)

[2K6-GS-7d-03]Visual Access Boundaries in Vision-Language Models

〇Hiroto Osaka1, Shohei Taniguchi1, Gouki Minegishi1, Kai Yamashita1, Masahiro Suzuki1, Yutaka Matsuo1 (1. University of Tokyo)

[2K6-GS-7d-04]FasTARFlow: Distilling Transformer-based Autoregressive Flows into Fast Inverse Autoregressive Models

〇Kai Yamashita1, Shohei Taniguchi1, Masahiro Suzuki1, Yutaka Matsuo1 (1. The University of Tokyo)

[2K6-GS-7d-05]Frequency-ordered Autoregressive Image Generation Model with Adaptive Scheduling

〇Daiki Miyake1, Masahiro Suzuki1, Yutaka Matsuo1 (1. The University of Tokyo)