Oral Session: Vision And Language (O2-B.T2)
Schedule
Monday 17 August, 16h30-17h50
Venue
Gratte-Ciel 1-2
Session Chair
Chiou-Ting Hsu
Track 2: Computer and Robot Vision
Details
| time | # | Title and Authors | Link pdf |
|---|---|---|---|
| 16h30-16h50 | 155 |
Semalign: Language Guided Semi-Supervised Domain Generalization
Fernando, Muditha; Kailainathan, Kajhanan; Nagaratnam, Krishnakanth; Senavirathne, Isuranga; Rodrigo, Ranga
presented by: Fernando, Muditha
slides
|
paper |
| 16h50-17h10 | 307 |
Pixel-To-4D: Camera-Controlled Image-To-Video Generation With Dynamic 3D Gaussians
de Almeida, Melonie; Ivanova, Daniela; Shi, Tong; Williamson, John; Henderson, Paul
presented by: de Almeida, Melonie
slides
|
paper |
| 17h10-17h30 | 367 |
Dynamic Context Adapters: Efficiently Infusing History Into Vision-And-Language Models
Song, Yuhang; Lin, Bor-Jiun; Liu, Jiaxu; Chiu, Te-Chuan; Nguyen, Anh; Lee, Chun-Yi
presented by: Song, Yuhang
|
paper |