Skip to main content Skip to main navigation menu Skip to site footer
Proceedings of the AAAI Conference on Artificial Intelligence
  • Current
  • Archives
  • About
    • About the Journal
    • Submissions
    • Privacy Statement
    • Contact
  • Login
  1. Home /
  2. Search

Search

Advanced filters
Published After
Published Before

Search Results

Found 15374 items.
  • Points Meet Pixels: Bridging 2D Vision-Language Model and 3D Perception Gaps for Point Cloud Quality Assessment

    Mingxuan Li, Zihao Huang, Xiaohui Chu, Fazhan Zhang, Bohan Fu, Runze Hu
    6342-6350
    2026-03-14
  • SSR-SAM: Retrieval-Style Segment Anything Model for Semi-Supervised Ultra-High-Resolution Image Segmentation

    Shijie Li, Yiming Chen, Zhineng Chen, Kai Hu, Xieping Gao
    6387-6395
    2026-03-14
  • From Dataset to Real-world: General 3D Object Detection via Generalized Cross-domain Few-shot Learning

    Shuangzhi Li, Junlong Shen, Lei Ma, Xingyu Li
    6415-6423
    2026-03-14
  • WorldGrow: Generating Infinite 3D World

    Sikuang Li, Chen Yang, Jiemin Fang, Taoran Yi, Jia Lu, Jiazhong Cen, Lingxi Xie, Wei Shen, Qi Tian
    6433-6441
    2026-03-14
  • SurgPub-Video: A Comprehensive Surgical Video Framework for Enhanced Surgical Intelligence in Vision-Language Model

    Yaoqian Li, Xikai Yang, Dunyuan Xu, Yang YU, Litao Zhao, Xiaowei Hu, Jinpeng Li, Pheng-Ann Heng
    6628-6635
    2026-03-14
  • Drive-R1: Bridging Reasoning and Planning in VLMs for Autonomous Driving with Reinforcement Learning

    Yue Li, Meng Tian, Dechang Zhu, Jiangtong Zhu, Zhenyu Lin, Zhiwei Xiong, Xinhai Zhao
    6708-6716
    2026-03-14
  • MM-R1: Unleashing the Power of Unified Multimodal Large Language Models for Personalized Image Generation

    Qian Liang, Yujia Wu, Kuncheng Li, Jiwei Wei, Shiyuan He, Jinyu Guo, Ning Xie
    6835-6843
    2026-03-14
  • Anatomical Region-Guided Contrastive Decoding: A Plug-and-Play Strategy for Mitigating Hallucinations in Medical VLMs

    Xiao Liang, Chenxi Liu, Zhi Ma, Di Wang, Bin Jing, Quan Wang, Yuanyuan Shi
    6871-6879
    2026-03-14
  • IPFormer: Instance Prompt-guided Transformer for Multi-modal Multi-shot Video Understanding

    Yujia Liang, Jile Jiao, Xuetao Feng, Xinchen Liu, Kun Liu, Yuan Wang, Zixuan Ye, Hao Lu, Zhicheng Wang
    6907-6915
    2026-03-14
  • Skeletons Speak Louder than Text: A Motion-Aware Pretraining Paradigm for Video-Based Person Re-Identification

    Rifen Lin, Alex Jinpeng Wang, Jiawei Mo, Min Li
    6970-6978
    2026-03-14
  • MRT: Learning Compact Representations with Mixed RWKV-Transformer for Extreme Image Compression

    Han Liu, Hengyu Man, Xingtao Wang, Wenrui Li, Debin Zhao
    7141-7149
    2026-03-14
  • ReFINE: A Reward-Based Framework for Interpretable and Nuanced Evaluation of Radiology Report Generation

    Yunyi Liu, Yingshu Li, Zhanyu Wang, Xinyu Liang, Lingqiao Liu, Lei Wang, Luping Zhou
    7413-7421
    2026-03-14
  • MoEGaze: A Mixture of Experts Approach for Generalizable Gaze Estimation

    Zheng Liu, Feng Lu
    7440-7448
    2026-03-14
  • PUFM: Efficient Point Cloud Upsampling via Flow Matching

    Zhi-Song Liu, Chenhang He, Yakun Ju, Lei Li
    7458-7466
    2026-03-14
  • LUMIN: A Longitudinal Multi-modal Knowledge Decomposition Network for Predicting Breast Cancer Recurrence

    Chunyao Lu, Tianyu Zhang, Xinglong Liang, Yuan Gao, Luyi Han, Xin Wang, Nika Rasoolzadeh, Tao Tan, Ritse Mann
    7530-7538
    2026-03-14
  • DCA-LUT: Deep Chromatic Alignment with 5D LUT for Purple Fringing Removal

    Jialang Lu, Shuning Sun, Pu Wang, Chen Wu, Feng Gao, Lina Gong, Dianjie Lu, Guijuan Zhang, Zhuoran Zheng
    7557-7564
    2026-03-14
  • 3DTeethSAM: Taming SAM2 for 3D Teeth Segmentation

    Zhiguo Lu, Jianwen Lou, Mingjun Ma, Hairong Jin, Youyi Zheng, Kun Zhou
    7609-7617
    2026-03-14
  • Negative Entity Suppression for Zero-Shot Captioning with Synthetic Images

    Zimao Lu, Hui Xu, Bing Liu, Ke Wang
    7636-7643
    2026-03-14
  • Phys-Liquid: A Physics-Informed Dataset for Estimating 3D Geometry and Volume of Transparent Deformable Liquids

    Ke Ma, Yizhou Fang, Jean-Baptiste Weibel, Shuai Tan, Xinggang Wang, Yang Xiao, Yi Fang, Tian Xia
    7782-7790
    2026-03-14
  • UM-Text: A Unified Multimodal Model for Image Understanding and Visual Text Editing

    Lichen Ma, Xiaolong Fu, GaojingZhou , Zipeng Guo, Ting Zhu, Yichun Liu, Yu Shi, Jason Li, Junshi Huang
    7791-7799
    2026-03-14
  • PA-FAS: Towards Interpretable and Generalizable Multimodal Face Anti-Spoofing via Path-Augmented Reinforcement Learning

    Yingjie Ma, Xun Lin, Yong Xu, Weicheng Xie, Zitong Yu
    7856-7864
    2026-03-14
  • Omni-Effects: Unified and Spatially-Controllable Visual Effects Generation

    Fangyuan Mao, Aiming Hao, Jintao Chen, Dongxia Liu, Xiaokun Feng, Jiashu Zhu, Meiqi Wu, Chubin Chen, Jiahong Wu, Xiangxiang Chu
    7927-7935
    2026-03-14
  • Next Patch Prediction for AutoRegressive Visual Generation

    Yatian Pang, Peng Jin, Shuo Yang, Bin Zhu, Bin Lin, Chaoran Feng, Zhenyu Tang, Liuhan Chen, Francis E. H. Tay, Ser-Nam Lim, Harry Yang, Li Yuan
    8260-8268
    2026-03-14
  • TextShield-R1: Reinforced Reasoning for Tampered Text Detection

    Chenfan Qu, Yiwu Zhong, Jian Liu, Xuekang Zhu, Bohan Yu, Lianwen Jin
    8621-8629
    2026-03-14
  • SegDINO3D: 3D Instance Segmentation Empowered by Both Image-Level and Object-Level 2D Features

    Jinyuan Qu, Hongyang Li, Xingyu Chen, Shilong Liu, Yukai Shi, Tianhe Ren, Ruitao Jing, Lei Zhang
    8649-8658
    2026-03-14
14701 - 14725 of 15374 items << < 584 585 586 587 588 589 590 591 592 593 > >> 

Information

  • For Readers
  • For Authors
  • For Librarians
  • Part of the
    PKP Publishing Services Network

Copyright © 2024, Association for the Advancement of Artificial Intelligence

More information about the publishing system, Platform and Workflow by OJS/PKP.