Oral Session: Vision And Language (O2-B.T2)
Schedule
Monday 17, 16h30-17h50
Venue
Gratte-Ciel 1-2
Session Chair
Chiou-Ting Hsu
Track 2: Computer and Robot Vision
Details
| time | # | Title and Authors | Link pdf |
|---|---|---|---|
| 16h30-16h50 | 155 |
Semalign: Language Guided Semi-Supervised Domain Generalization
Fernando, Muditha; Kailainathan, Kajhanan; Nagaratnam, Krishnakanth; Senavirathne, Isuranga; Rodrigo, Ranga
|
|
| 16h50-17h10 | 307 |
Pixel-To-4D: Camera-Controlled Image-To-Video Generation With Dynamic 3D Gaussians
de Almeida, Melonie; Ivanova, Daniela; Shi, Tong; Williamson, John; Henderson, Paul
|
|
| 17h10-17h30 | 367 |
Dynamic Context Adapters: Efficiently Infusing History Into Vision-And-Language Models
Song, Yuhang; Lin, Bor-Jiun; Liu, Jiaxu; Chiu, Te-Chuan; Nguyen, Anh; Lee, Chun-Yi
|
|
| 17h30-17h50 | 528 |
Mmfuser: Multimodal Multi-Layer Feature Fuser For Fine-Grained Vision-Language Understanding
Cao, Yue; Huang, Yong; Zhu, Wei; Liu, Yangzhou; Chen, Zhe; Shi, Guangchen; Fa, Yong; Yang, Yujie; Mei, Song; Lu, Tong
|