Poster Session 2
Schedule
Tuesday 18 August, 15h00-16h30
Venue
Forum (floor -2)
Session Chairs
Olga Cherednichenko and Mihaela Scuturici
Tracks presented:
- Track 1: Machine Learning and Artificial Intelligence in Pattern Recognition (54)
- Track 2: Object Detection And Recognition & Perception For Autonomous Navigation (46)
- Track 4: Biometrics and HCI (14)
- Track 5: Document Analysis and Recognition (20) 134 papers presented in total.
Details
| # and Track | Title and Authors | #grid board | |
|---|---|---|---|
| 45 T1
|
Hypercore: Coreset Selection Under Noise Via Hypersphere Models
Moser, Brian ; Shanbhag, Arundhati; Nauen, Tobias; Frolov, Stanislav; Raue, Federico; Folz, Joachim; Dengel, Andreas
|
PDF
|
#1 |
| 47 T1
|
Lfg: Local Controllable 3D Generation Using Latent Flexible Grid Representation
Zhang, Kaiyi; Han, Tian; Quan, Long
|
#2 | |
| 75 T1
|
Ac^2-Fuse: Syntax-Preserving Canonicalization And Cross-Model Curvature For Detecting Llm-Generated Code
Yang, Yuchen; Huang, Enhao; Xia, Chunshu; Yang, Bingrun; Pan, Tongtong; Zhang, Zhiyu; Dong, Dong; Qin, Zhan
|
PDF
|
#3 |
| 101 T1
|
Towards Time Series Generation Conditioned On Unstructured Natural Language
Woo, Jaeyun; Lee, Jiseok; Iwana, Brian Kenji
|
PDF
|
#4 |
| 103 T1
|
Lisu: Composable Layer-Wise Selective Unlearning For Large Language Models
Hendricks, Arne
|
#5 | |
| 120 T1
|
Corkhsi: Hyperspectral Anomaly Detection In Corks Using An Autoencoder With A Novel Spectral–Spatial Loss Optimization
Dini, Afshin; Delirie, Farnaz; Rahtu, Esa
|
PDF
|
#6 |
| 151 T1
|
Uncovering Logit Suppression Vulnerabilities In Llm Safety Alignment
li, yuxi; Liu, Yi; Li, Yuekang; Shi, Ling; Deng, Gelei; Chen, Shengquan; Wang, Kailong
|
#7 | |
| 159 T1
|
Compositional Novelty Metrics For Graph-Structured Data
Joshi, Rucha Bhalchandra; Mishra, Subhankar
|
PDF
|
#8 |
| 168 T1
|
Tunemia: Membership Inference Attack On Latent Diffusion Models
Azulay, Noam; Habler, Idan; Shabtai, Asaf; Elovici, Yuval
|
#9 | |
| 221 T1
|
Refinerag: Word-Level Poisoning Attacks Via Retriever-Guided Text Refinement
Wang, Ziye; Wang, Guanyu; Wang, Kailong
|
#10 | |
| 227 T1
|
When Safe Models Merge Into Danger: Exploiting Latent Vulnerabilities In Llm Fusion
Li, Jiaqing; Zhang, Zhibo; Zhou, Shide; Li, Yuxi; Yu, Tianlong; Wang, Kailong
|
#11 | |
| 236 T1
|
Kinetic Mining In Context: Few-Shot Action Synthesis Via Text-To-Motion Distillation
Cazzola, Luca; Alboody, Ahed
|
PDF
|
#12 |
| 243 T1
|
Efficient Score Pre-Computation For Diffusion Models Via Cross-Matrix Krylov Projection
Lau, Kai Kwan; Na, Andrew S.; Wan, Justin WL
|
#13 | |
| 262 T1
|
Towards Unified Music Emotion Recognition Across Dimensional And Categorical Models
Kang, Jaeyong; Herremans, Dorien
|
#14 | |
| 273 T1
|
Local Autoregression With Finite-Support Random Variables For Image Generation
zhao, chenqiu; Basu, Anup
|
PDF
|
#15 |
| 295 T1
|
Visually Informed Text Representations for Visual Contextual Classification of Arts
Raphaëlle, Lemaire; Pantin, Jeremie; Lechervy, Alexis; Kaibaldiyev, Azamat; Maurel, Fabrice; Dias, Gaël; Chahir, Youssef
|
#16 | |
| 375 T1
|
Smt-Net: Terrain-Guided Hybrid Neural Network For Meteorological Data Super-Resolution Reconstruction
Pan, Zhigeng; Zhang, Lifeng; Lin, Xianxuan; Wu, Xi; Meng, Fan; Wu, Timing
|
#17 | |
| 405 T1
|
What Matters In Virtual Try-Off? Dual-Unet Diffusion Models For Garment Reconstruction
Truong, Phat; Madadi, Meysam; Escalera, Sergio
|
#18 | |
| 415 T1
|
Multimodal Contrastive Enhancement Network For Cross-Ethnic Analysis Of Degenerative Brain Regions In Alzheimer'S Disease
Zhu, Haoran; Yu, Tong; Hua, Zhen; Ge, Ling; Wang, Jianjia
|
#19 | |
| 450 T1
|
Jailbreaking Llms Without Gradients Or Priors: Effective And Transferable Attacks
Nurlanov, Zhakshylyk; Schmidt, Frank R.; Bernard, Florian
|
#20 | |
| 531 T1
|
Unique Step Refinement For Transformer-Based Generative Models
Grimal, Paul; Le Borgne, Herve; Ferret, Olivier
|
#21 | |
| 537 T1
|
Graphexplainer: Explaining Nodes, Edges And Attributes Of Graph Neural Network Predictions
Segura-Alabart, Natàlia; Serratosa, Francesc; Lemoine, Jean Philippe
|
#22 | |
| 563 T1
|
Seeing Inside Deep Treatment Effect Models: A Representation-Level Evaluation
Khan, Ahmad Saeed; Schaffernicht, Erik; Stork, Johannes Andreas
|
#23 | |
| 598 T1
|
Exploiting Open-Set Noise With Adaptive Entropy Enhancement For Learning With Open-World Noisy Data
Luo, Qian; Geng, Chuanxing
|
PDF
|
#24 |
| 616 T1
|
Cloud-Edge Hybrid Reasoning: Decoupling Symbolic Correction From Large-Scale Generation
Wang, Rui
presented by: Yanchao Xiao
|
#25 | |
| 622 T1
|
Esplora: Enhanced Spatial Precision With Low-Rank Adaption In Text-To-Image Diffusion Models For High-Definition Synthesis
Rigo, Andrea; Stornaiuolo, Luca; Martino, Mauro; Lepri, Bruno; Sebe, Niculae
|
#26 | |
| 638 T1
|
Cryptoscope: Utilizing Large Language Models For Automated Cryptographic Logic Vulnerability Detection
Li, Zhihao; Ji, Zimo; Zheng, Tao; Ren, Hao; Lan, Xiao
|
#27 | |
| 647 T1
|
Idpad: Implicit And Dynamic Preference Alignment During Decoding
cai, xiangjun
|
#28 | |
| 701 T1
|
Visibility-Aware Diffusion-Based Face Anonymization For Real-World Deployment
LAHGAZI, Mohamed Jaouad; Tarel, Jean-Philippe
|
PDF
|
#29 |
| 757 T1
|
Inherently Interpretable Graph Neural Networks Via B-Cos Alignment
Pandey, Shruti ; Mishra, Subhankar
|
PDF
|
#30 |
| 773 T1
|
Merge-Bench: Resolve Merge Conflicts With Large Language Models
Schesch, Benedikt; Ernst, Michael
|
#31 | |
| 884 T1
|
Crome: Cross-Domain Image Colorization Using An Optimal Mixture Of Heterogeneous Experts
Chang, Zheng; Zhang, Jingzhe; Li, Si
|
#32 | |
| 888 T1
|
Istructtab: Structured Feature Sequencing For Multimodal Learning Of Image And Tabular Data
Habib, Al Zadid Sultan Bin; Ahamed, Md Younus; Gyawali, Prashnna; Doretto, Gianfranco; Adjeroh, Donald A.
|
#33 | |
| 915 T1
|
Cross-Lingual Vulnerabilities Of Text-To-Image Models: Evaluating Data Poisoning Attacks Across Ten Languages
Kakebayashi, Ryohei; Mori, Tatsuya
|
#34 | |
| 947 T1
|
Approximate Natural Neighbors For Hyperspectral Images
MOULAY OMAR, IMENE; Vozel, Benoit; Le Moan, Steven
|
#35 | |
| 991 T1
|
Automated Smart Data Curation Via Embedding-Based Scenario Retrieval
Magyar, Dávid; Lányi, Zsombor; Tóth, Tekla
|
#36 | |
| 1001 T1
|
Ifagenet: Identity-Aware Face Aging Via Feature Inversion And Age-Conditioned Adaptive Latent Shifts
Pyeon, Su Jang; Kim, Seong-Heon; Nam, Woo-Jeoung
|
#37 | |
| 1014 T1
|
Hgdl: Holistic Graph Distribution Learner For High-Fidelity Small Graph Generation
Wang, Haoyu; Wang, Zheng; Yan, Xinyu; Sun, Meijun
|
#38 | |
| 1037 T1
|
Uniform Llm-Based Framework For Explainable Recommender Systems
LAKTAOUI, Hajar; LECHIAKH, Mohamed ; BASMADJIAN, Robert ; AZIZI, Lamiae
|
#39 | |
| 1154 T1
|
Sequential Enumeration In Large Language Models
hou, kuinan; zorzi, marco; testolin, alberto
|
#40 | |
| 1166 T1
|
Diff-Stygs: 3D Gaussian Splatting Stylization Via Tuning-Free Multi-View Sparse Diffusion
Li, Yize; Lu, Lei; Kong, Zhenglun; Wang, Yanzhi; Zhao, Pu; Lin, Xue
|
#41 | |
| 1172 T1
|
Graph Contrastive Learning For Tag-Aware Influence Maximization
Dam, Arpan; Pathak, Sayan; Mitra, Bivas
presented by: Shri Suklav Ghosh
|
#42 | |
| 1187 T1
|
Pecker: A Precisely Efficient Critical Knowledge Erasure Recipe For Machine Unlearning In Diffusion Models
Ma, Zhiyong; Deng, Zhitao; Tang, Huan; Chen, Jialin; Zheng, Zhijun; Li, Zhengping; Chuai, Qingyuan
|
#43 | |
| 1241 T1
|
Serc: Ldpc-Inspired Semantic Error Correction For Retrieval-Augmented Generation
Kim, Gyumin; Park, Juhwan; Kim, Jaeha; Han, Seunggyun; Son, Kyungrak; Jang, Ikbeom
|
#44 | |
| 1246 T1
|
Sync-Flow: Synchronization-Aware One-Step Generative Model For Audio-Visual Speech Enhancement
Liu, Yichen; Wang, Weiqiang
|
#45 | |
| 1251 T1
|
Cvglobal And Zesco: Geographically Balanced Cross-View Zero-Shot Orientation Estimation
Russo, Leonardo; Marcos, Diego; Fraga Dantas, Cassio; Ienco, Dino
|
#46 | |
| 1267 T1
|
Efficient Concept Unlearning In Latent Diffusion Models Via Feature Caching
Sharma, Mridul; Hase, Ajinkya Prakash; Kancharla, Parimala
|
#47 | |
| 1302 T1
|
Discrete World Models Via Regularization
Bizzaro, Davide; Serafini, Luciano
|
#48 | |
| 1349 T1
|
A Pre-Image Representer Theorem In Machine Learning
Honeine, Paul
|
#49 | |
| 1442 T1
|
H2Gkt: A Hybrid Heterogeneous Graph Framework For Knowledge Tracing
Azizian Foumani, Arash; Qi, Xiaojun
|
#50 | |
| 1471 T1
|
Dgssm: Diffusion Guided State-Space Models For Multimodal Salient Object Detection
Ghosh, Suklav; Sur, Arijit; Mitra, Pinaki
|
#51 | |
| 1480 T1
|
When Gnns Meet Moe: From Structural Design To Representation-Level Analysis
Min, Suyeon; Lee, Jaekang; Noh, Dasom; Suh, Minjy; Kwon, Sunyoung
|
#52 | |
| 1507 T1
|
Partial-Correlation Learning For Large Language Models With Skip-Tuning
Lu, Yuheng; Song, Zuhe; Yuan, Caixia; Wang, Xiaojie
|
#53 | |
| 1635 T1
|
Versediffuser: Multi-Level Cross-Sentence Structural And Semantic Fusion For Classical Chinese Poetry Generation
Sun, PeiHong; Lu, Jun
|
#54 | |
| 8 T2
|
Hstc-Moseg: A Hierarchical Spatially Adaptive And Temporally Consistent Network For Radar Point Cloud Moving Object Segmentation
Luo, Zhengjie; Zhang, Jinlai; Deng, Qinrui; Yan, Ruyu; Gao, Kai; Chao, Ong Zhi
|
PDF
|
#55 |
| 16 T2
|
Skeleton-Snippet Contrastive Learning With Multiscale Feature Fusion For Action Localization
Cheng, Qiushuo; Liu, Jingjing; Morgan, Catherine; Whone, Alan; Mirmehdi, Majid
|
#56 | |
| 33 T2
|
NP-DeSiRe-GS: Neighborhood Planarity-Enhanced Gaussian Splatting for Robust Static-Dynamic Object Separation and Surface Alignment in Urban Scenes
Verma, sachin; Wintel, Florian ; Lindseth, Frank; Kiss, Gabriel
|
#57 | |
| 94 T2
|
Bem: Training-Free Background Embedding Memory For False-Positive Suppression In Real-Time Fixed-Background Camera
Park, Junwoo; Lee, Jangho; Lim, Sunho
|
PDF
|
#58 |
| 143 T2
|
Collidenet: Hierarchical Multi-Scale Video Representation Learning With Disentanglement For Time-To-Collision Forecasting
Desai, Nishq; Etemad, Ali; Greenspan, Michael
|
#59 | |
| 215 T2
|
Diversity-Aware Multi-Prompt Learning For Compositional Zero-Shot Learning
Chen, Ziyi; Zhao, Xinru; Lang, Congyan
|
#60 | |
| 217 T2
|
P4: Place With Purpose -- Pose And Prompt-Guided Human Synthesis In Real Scenes
KHAN, DADAN; Zohaib, Mohammad; Timofte, Radu; Odone, Francesca
|
#61 | |
| 235 T2
|
Higher-Order Adversarial Patches For Real-Time Object Detectors
Bayer, Jens; Münch, David; Becker, Stefan; Arens, Michael; Beyerer, Jürgen
|
#62 | |
| 244 T2
|
Gnc-Pose: Geometry-Aware Gnc-Pnp For Monocular 6D Pose Estimation
Liu, Xiujin
presented by: Chen Wang
|
#63 | |
| 334 T2
|
Comparison Of Real-Time Multi Object Tracking With Limited Hardware Resources
Bernhart, Costin; Strohmayer, Julian; Kampel, Martin; Peer, Marco; Kleber, Florian
|
#64 | |
| 349 T2
|
Multimodal Feature Fusion With Illumination Adaptation For Robust Household Waste Detection
Hu, Ziliang; Wu, Xiguang; Zhou, Jiuren; Liu, Yan; Han, Genquan
|
#65 | |
| 360 T2
|
Consplat: 3D Segmentation From Dual Consistency Via 2D-3D Gradient And 3D-2D Projection
Lyu, Hongchang; Yang, Minghao; Pan, Hang; Liu, Chang; Jiao, Yingjie; Chen, Jinlong; Zhao, Yongjia; Zhan, Yongsong
|
#66 | |
| 448 T2
|
Improving Proactive Risk-Awareness Of Autonomous Driving Via Trajectory Monitoring
Zhao, Xue; Li, Xianfei; Peng, Pai; Ye, Nanyang
|
#67 | |
| 473 T2
|
Metapath-Driven Embeddings For Zero-Shot Object State Classification
Gouidis, Filippos; Papoutsakis, Konstantinos; Patkos, Theodore; Argyros, Antonis; Plexousakis, Dimitris
|
#68 | |
| 533 T2
|
Selfxtface: Attention Based Feature Pyramid Network In Face Detection
Kasım, Furkan; Kirchdorfer, Carlos; Mohammad, Salman; Günther, Manuel
|
#69 | |
| 550 T2
|
Tag-Head: Time-Aligned Graph Head For Plug-And-Play Fine-Grained Action Recognition
Ul Hassan, Imtiaz; Bessis, Nik ; Behera, Ardhendu
|
PDF
|
#66 |
| 587 T2
|
Rethinking Open Vocabulary Video Anomaly Detection - Normality Matters
Deng, Yunhui; Wang, Hongxing
|
PDF
|
#70 |
| 603 T2
|
Ray Augmented Supervision For 3D Object Detection
Duong, Huy-Hoang; Allibert, Guillaume; Voicila, Adrian
|
#71 | |
| 663 T2
|
The Detector Teaches Itself: Lightweight Self-Supervised Adaptation For Open-Vocabulary Object Detection
Wan, Yazhe; Oh, Changjae
|
#72 | |
| 783 T2
|
Sonar-Fert: An Accurate Detector Based On Rt-Detr For Underwater Sonar Imagery
Sun, Yumeng; Lian, Zhichao
|
#73 | |
| 845 T2
|
Fm-Ad: Feature Density Modeling For Unsupervised Anomaly Detection With Continuous Normalizing Flows
Bøss, Jonathan; Wilm, Jakob
|
#74 | |
| 874 T2
|
From Datagloves To Deep Networks: A Survey Of Sign Language Recognition And Multimodal Approach
Khan, Usman; Ma, Zeyang ; Mansoor, Atif
|
#75 | |
| 964 T2
|
Structure-Aware Phase-Based Dual Alignment For Robust Uav Object Detection
Baek, Minju; Oh, Hyeongseok; Yoon, Jaehong; Lee, Eunseon; Kim, Bogyeong; Paik, Joonki
|
#76 | |
| 977 T2
|
Scg-Ssc: Semantic Scene Completion Via Self-And-Cross Gated Fusion Of Depth Maps And Semantic Priors
Feng, Cheng; Zhang, Congxuan; Chen, Zhen; Hu, Weiming; Lu, Ke; Ge, Liyue
|
#77 | |
| 993 T2
|
From Image Hashing To Scene Change Detection
Duong, Anh Kiet; Iatrides, Marie-Claire; Gomez-Krämer, Petra; Carozza, Jean-Michel
|
#78 | |
| 1028 T2
|
Global–Local Feature Decoding With Adapter-Guided Samv2 For Salient Object Detection
Moradi, Morteza; Moradi, Mohammad; Palazzo, Simone; Borji, Ali; Spampinato, Concetto
|
#79 | |
| 1041 T2
|
Rsd-Bev: Residual Self-Distillation Framework For Efficient Bev Representation Learning
Park, Sungjin; Song, Jaeha; Hwang, Soonmin
|
#80 | |
| 1049 T2
|
Mile: Mixture Of Incremental Lora Experts For Continual Semantic Segmentation Across Domains And Modalities
Muralidhara, Shishir; Stricker, Didier; Schuster, René
|
#81 | |
| 1071 T2
|
Src-Conv: Statistical Recalibration Convolution For Amorphous Fire And Smoke Detection
Nan, Ding; Haozheng, Sun; Wenyu, Luo; Masaki, Minami; Jinhui, Chen
|
#82 | |
| 1089 T2
|
Mmla-Yolo11N: Neck Slimming With Dynamic Upsampling And Lightweight Attention For Steel Surface Defect Detection
Peijun Liang
|
#83 | |
| 1093 T2
|
Mc-Depth: Modular And Compute-Efficient Monocular Depth Estimation For Outdoor On-Board Vehicle Perception Systems
IATRIDES, Marie-Claire; Gomez-Krämer, Petra; Ben Ahmed, Olfa; Marchand, Sylvain
|
#84 | |
| 1132 T2
|
Spiking Transformer Framework For Event-Based Object Detection
Ullah, Wasi; Ambellouis, Sébastien ; Tatkeu, Charles
|
#85 | |
| 1196 T2
|
Hffdet: Real-Time Point Cloud Object Detector Based On Hierarchical Feature Fusion
Li, Yuan; Song, Mengdie; Xie, Qihu; Meng, Yulong; Chen, Song; Kang, Yi
|
#86 | |
| 1249 T2
|
Spnc-Yolo: An Architecture-Optimized Framework For Real-Time Small Object Detection In Uav Imagery
Li, Feng; Zhang, Yuhang
|
#87 | |
| 1276 T2
|
Yolo-Sacam: A Switchable Convolution And Attention-Based Yolo Network For Wind Turbine Blade Defects Detection
Liu, Yi; Liu, Guiping; LIU, NA; Zhang, Yunxin; Yang, Long; Liu, Tan; Liu, Kunjie; Lu, Min; Li, Wenjing
|
#88 | |
| 1293 T2
|
Radial Distortion Homography Estimation From Affine-Covariant Or Orientation-Covariant Features
Valtonen Örnhag, Marcus; Adalbjörnsson, Stefan
|
#89 | |
| 1330 T2
|
Srd-Fusion: Self-Supervised Rgb–Depth Fusion For Indoor Scene Categorization
Brito, Alternei; Borges, Paulo; Drews-Jr, Paulo; Oliveira, Felipe
|
#90 | |
| 1340 T2
|
Domain-Agnostic Semantic Segmentation Via Angular Separation And Synthetic Diversity
KAS, Mohamed; Kajo, Ibrahim; Nekamiche, Noha; Ruichek, Yassine
|
#92 | |
| 1364 T2
|
Beyond Visual Appearance: Retrieval-Based Validation Of Object Detectors Via Ood Knowledge Bases
Moustafa, Mohamed Sabry; Bieshaar, Maarten; Albrecht, Andreas; Sick, Bernhard
|
#93 | |
| 1420 T2
|
Msf-Yolo: Steel Surface Defect Detection With Multi-Scale Spectral And Spatial Bidirectional Feature Fusion
Huang, Weixing; Ma, Ying; Wang, Bo; Yang, Fengyu; He, Wenting; Chen, Ying
|
#94 | |
| 1440 T2
|
Break Out The Silverware: Semantic Understanding Of Stored Household Items
Levi Richter, Michaela; Mirsky, Reuth; Glickman, Oren
|
PDF
|
#95 |
| 1456 T2
|
Multimodal Knowledge Distillation For Acoustic-Aware Object Detection
Hazra, Saheli; Hussain, Nushrat; Das, Sudip; Das, Arindam; Bhattacharya, Ujjwal
|
#96 | |
| 1510 T2
|
Hybrid Guided Variational Autoencoder For Visual Place Recognition
Wang, Ni; You, Zihan; Neftci, Emre ; Schoepe, Thorben
|
#97 | |
| 1520 T2
|
Satmap: Revisiting Satellite Maps As Prior For Online Hd Map Construction
Mazumder, Kanak; Flohr, Fabian
|
#98 | |
| 1530 T2
|
A Collimator-Based Calibration Method For Generic Camera Models
Liang, Shunkun; Sun, Pengju; Guan, Banglei; Liu , Zibin ; Shang, Yang; Li, Zhang; Liu, Xiaolin; Yu, Qifeng
|
#99 | |
| 1553 T2
|
Mambabev: An Bev-Based 3D Detection Model With Mamba2
You, Zihan; Wang, Ni; Wang, Hao; Zhao, Qichao; Wang, Jinxiang
|
#100 | |
| 200 T4
|
TeleRank: Listwise Ranking of Temporal Driver Performance Using Telemetry
Röscher, Anton; van der Haar, Dustin
|
#101 | |
| 231 T4
|
Trusted But Tainted: Enrolment Perturbations That Undermine Morphing Attack Detection And Face Recognition
Kamble, Dhammadip; Patwardhan, Sushrut; Sao, Anil; Sharma, Arvind; Ramachandra, Raghavendra
|
PDF
|
#102 |
| 362 T4
|
Fieldworkarena: Agentic Ai Benchmark For Real Field Work Tasks
Takahashi, Jun; Moteki, Atsunori; Uchida, Akiyoshi; Masui, Shoichi; Yang, Fan; Uchino, Kanji; Song, Yueqi; Bisk, Yonatan; Neubig, Graham; Kusajima, Ikuo; Watanabe, Yasuto; Ishida, Hiroyuki; Nakagawa, Koki; Jiang, Shan
|
#103 | |
| 402 T4
|
Stegano-Obf: Privacy-Preserving Obfuscation For Action Recognition Datasets Via Semantic Embedding
Nakabayashi, Takuya; Babazaki, Yasunori; Shibata, Takashi; Takahashi, Toru
|
PDF
|
#104 |
| 454 T4
|
Rq-Pad: Reconstruction Quality For Robust Face Presentation Attack Detection
Bouzid, Hamza; Lézoray, Olivier; Rosenberger, Christophe
|
#106 | |
| 534 T4
|
Dk-Msp: Integrating Domain Knowledge Into Multi-Stage Prompting Engineerinng For Aspect-Level Multimodal Sentiment Analysis
Feng, Haiwei; Zhang, Qi; Yang, Shuo; Li, Yutong; Xie, Ziye; Xiao, Zhiqun
|
#107 | |
| 654 T4
|
Period-Aware And Prior-Constrained Adaptive Orthogonal Model For Eeg Emotion Recognition
Wu, Jianing; Hao, Yanrong; Zhang, Chenchen; Bian, Jing; Wen, Xin; Zhou, Mengni; Cao, Rui
|
#108 | |
| 679 T4
|
Beyond Texture: Advanced Facial Privacy Protection Via Hierarchical Diffusion Autoencoder
Lu, Ting-Yi; Lin, Che-Tsung; Zach, Christopher; Lai, Shang-Hong
|
#109 | |
| 779 T4
|
Towards Personalized Multimodal Efficient Detection Of Human Circadian States
Das, Kapotaksha; Burzo, Mihai; Abouelenien, Mohamed
|
#110 | |
| 835 T4
|
Uavdb: Point-Guided Masks For Uav Detection And Segmentation
Chen, Yu-Hsi
|
PDF
|
#111 |
| 853 T4
|
Leveraging Rgb Images For Pre-Training Of Event-Based Hand Pose Estimation
Liu, Ruicong; Ohkawa, Takehiko; Tse, Tze Ho Elden; Zhang, Mingfang; Yao, Angela; Sato, Yoichi
|
#112 | |
| 914 T4
|
3D Wavelet-Based Structural Priors For Controlled Diffusion In Whole-Body Low-Dose Pet Denoising
Jing, Peiyuan; Yang, Yue; Cheng, Chun-Wun; Zhang, Zhenxuan; Yang, Liutao; Lima, Thiago; Strobel, Klaus; Leimgruber, Antoine; Aviles-Rivero, Angelica; Yang, Guang; Montoya, Javier
|
#113 | |
| 922 T4
|
Local Anchor Embedding For Robust Face Recognition Via Progressive Global-Local Fusion
Ud Din, Nizam; Siddiqui, Shahid; Ahmed, Fawad; Aldahlawi, Abdullah
|
#114 | |
| 601 T4
|
Embedding Arithmetic: A Lightweight, Tuning-Free Framework For Post-Hoc Bias Mitigation In Text-To-Image Models
Thirugnana Sambandham, Venkatesh; Schön, Torsten
|
PDF
|
#115 |
| 324 T5
|
Hct-Net: A Hybrid Cnn-Transformer Network For Robust Oracle Bone Script Recognition
Wang, Yibo; Zuo, Yanni; Jiang, Lanxin; Qian, Chong; Ubul, Kurban
|
#116 | |
| 412 T5
|
Rethinking The Pointer Loss In Table Structure Recognition: Geometry-Aware Pointer Loss For Spatial Locality
Choi, Hong-Jun; Lee, Jongho; Kim, Jaeyoung
|
#117 | |
| 470 T5
|
When Not To Answer: Evaluating Prompts On Reasoning Models For Effective Abstention In Unanswerable Math Word Problems
Saadat, Asir; Sogir, Tasmia Binte ; Chowdhury, Md Taukir Azam; Aziz, Syem
|
#118 | |
| 540 T5
|
Llm-Umls-Pico: A Large Language Model-Based Pico Extraction Method With Umls Semantic Validation
Qiao, Chungeng; Zhang, Meiqi; Huang, Hongfa; Yin, Yipeng; Xiao, Wei
|
#119 | |
| 597 T5
|
Stableskip: Stability-Guided Dynamic Token Skipping For Efficient Large Language Model Inference
Wu, Daokuan
|
#120 | |
| 604 T5
|
Hybrid Classical-Quantum Architecture For Vectorised Image Classification Of Hand-Written Sketches
Cordero Carrasco, Yeray; Biswas, Sanket; Vilariño, Fernando; Bilkis, Matias
|
PDF
|
#121 |
| 652 T5
|
Parameter Efficient American Sign Language Recognition Via Mediapipe Landmarks
Varanasi, Abhishek; sinha, manjira; Dasgupta, Tirthankar
|
#122 | |
| 767 T5
|
Fine-Tuning Llms With Extracted Rationales For Attributed Text Generation
Cao, Zelin; Zhao, Boxiang; Wang, Yi; Cheng, Peng; Lin, Bo
|
#123 | |
| 789 T5
|
Bridging The Arithmetic Gap: The Cognitive Complexity Benchmark And Financial-Pot For Robust Financial Reasoning
Zhao, Boxiang; Li, Qince; Wang, Zhonghao; Wang, Yi; Cheng, Peng; Lin, Bo
|
#124 | |
| 792 T5
|
Decoding-Time Fusion Of Ocr And Large Language Models For Traditional Chinese Historical Document Recognition
Lin, Zih-Ci; Liao, Wen-Hung
|
PDF
|
#125 |
| 871 T5
|
Too Simple Or Too Complex? Using Linguistic Signatures For Ai-Generated Text Detection
Schäfer, Karla; Bassenge, Mareike
|
#126 | |
| 974 T5
|
Visual Information Facilitation Scene Text Retrieval
Ibrayim, Mayire ; Luo, Hailong ; Li, Pengyang
|
#127 | |
| 1011 T5
|
The Pragmatic Persona: Discovering Llm Persona Through Bridging Inference
Ryu, Jongwon; Yang, Jisoo; Ma, Minuk; Pham, Trung X.; Kim, Junyeong
|
PDF
|
#128 |
| 1123 T5
|
Mstis: Multi-Views Scene Text Image Sequencing To Enhance Text Detection Performance
Das Gupta, Debayan Das ; Roy, Jayasmita; Palaiahnakote, Shivakumara ; Pal, Umapada
|
#129 | |
| 1128 T5
|
Sketch-Clip: Efficient Clip Adaptation For Few-Shot Sketch Classification
Xu, Yunqi; Suen, Ching Yee
presented by: Yifan Zhang
|
#130 | |
| 1370 T5
|
Semantic-Guided Reading Order Reconstruction In Historical Armenian Newspapers With Llms
Vidal-Gorène, Chahan; Tomeh, Nadi; Khurshudyan, Victoria
|
#131 | |
| 1436 T5
|
Toep: Task-Specific Operator Evolution Via Multi-Objective Pareto Optimization For Automatic Workflow Generation
Leng, Chunlin; Kang, Xiaomian; Wang, Haixin; Ren, Shuo; Zhang, Jiajun
|
#132 | |
| 1489 T5
|
Differentially Private Datastore Generation For Retrieval-Augmented Inference
Wael, Abdelrahman; Torki, Marwan
|
#133 | |
| 1512 T5
|
Universal Adversarial Suffixes Using Calibrated Gumbel–Softmax Relaxation
Soor, Sampriti; Ghosh, Suklav; Sur, Arijit
|
#134 | |
| 1519 T5
|
Self-Supervised Learning Of Contextualized Neural Topic Models With Vic Regularization
Hirami, Kengo; Xu, Weiran; Eguchi, Koji
|
#135 |