Skip to main content Skip to main navigation menu Skip to site footer
Proceedings of the AAAI Conference on Artificial Intelligence
  • Current
  • Archives
  • About
    • About the Journal
    • Submissions
    • Privacy Statement
    • Contact
  • Login
  1. Home /
  2. Search

Search

Advanced filters
Published After
Published Before

Search Results

Found 14874 items.
  • Less Is More: Vision Representation Compression for Efficient Video Generation with Large Language Models

    Yucheng Zhou, Jihai Zhang, Guanjie Chen, Jianbing Shen, Yu Cheng
    13826-13834
    2026-03-14
  • Instruction-Guided Cross-Modal Clustering for Training-Free Visual Token Pruning in Vision-Language Models

    Yunqian Yu, Biao Chen, Yunya Zhang, Tonglan Xie, Mengmeng Jing, Lin Zuo
    12213-12221
    2026-03-14
  • Enhancing Vision-Language Models with Morphological and Taxonomic Knowledge: Towards Coral Recognition for Ocean Health

    Hongyong Han, Wei Wang, Gaowei Zhang, Mingjie Li, Yi Wang
    28052-28060
    2025-04-11
  • Beyond Boundaries: Leveraging Vision Foundation Models for Source-Free Object Detection

    Huizai Yao, Sicheng Zhao, Pengteng Li, Yi Cui, Shuo Lu, Weiyu Guo, Yunfan Lu, Yijie Xu, Hui Xiong
    11866-11874
    2026-03-14
  • FigStep: Jailbreaking Large Vision-Language Models via Typographic Visual Prompts

    Yichen Gong, Delong Ran, Jinyuan Liu, Conglei Wang, Tianshuo Cong, Anyu Wang, Sisi Duan, Xiaoyun Wang
    23951-23959
    2025-04-11
  • Unveiling the Fragility of Vision-Language Models: Multi-Modal Adversarial Synergy via Texture-Constrained Perturbations and Cross-Modal Optimization

    Xiang Fang, Wanlong Fang, Changshuo Wang
    3867-3875
    2026-03-14
  • SAVER: Mitigating Hallucinations in Large Vision-Language Models via Style-Aware Visual Early Revision

    Zhaoxu Li, Chenqi Kong, Yi Yu, Qiangqiang Wu, Xinghao Jiang, Ngai-Man Cheung, Bihan Wen, Alex Kot, Xudong Jiang
    35617-35625
    2026-03-14
  • AutoMMLab: Automatically Generating Deployable Models from Language Instructions for Computer Vision Tasks

    Zekang Yang, Wang Zeng, Sheng Jin, Chen Qian, Ping Luo, Wentao Liu
    22056-22064
    2025-04-11
  • MMJ-Bench: A Comprehensive Study on Jailbreak Attacks and Defenses for Vision Language Models

    Fenghua Weng, Yue Xu, Chengyan Fu, Wenjie Wang
    27689-27697
    2025-04-11
  • MegaCoin: Enhancing Medium-Grained Color Perception for Vision-Language Models

    Ming-Chang Chiu, Shicheng Wen, Pin-Yu Chen, Xuezhe Ma
    37305-37313
    2026-03-14
  • RFI: Rectified Flow Intervention for Mitigating Object Hallucination in Large Vision-Language Models

    Junyu Cheng, Zhibiao Liang, Yidong Chen, Shuangyin Li
    3255-3263
    2026-03-14
  • TTF-VLA: Temporal Token Fusion via Pixel-Attention Integration for Vision-Language-Action Models

    Chenghao Liu, Jiachen Zhang, Chengxuan Li, Zhimu Zhou, Shixin Wu, Songfang Huang, Huiling Duan
    18452-18459
    2026-03-14
  • Compensating Distribution Drifts in Continual Learning with Pre-trained Vision Transformers

    Xuan Rao, Simian Xu, Zheng Li, Bo Zhao, Derong Liu, Mingming Ha, Cesare Alippi
    25090-25098
    2026-03-14
  • Attention Guided CAM: Visual Explanations of Vision Transformer Guided by Self-Attention

    Saebom Leem, Hyunseok Seo
    2956-2964
    2024-03-24
  • MoLe-VLA: Dynamic Layer-skipping Vision Language Action Model via Mixture-of-Layers for Efficient Robot Manipulation

    Rongyu Zhang, Menghang Dong, Yuan Zhang, Liang Heng, Xiaowei Chi, Gaole Dai, Li Du, Dan Wang, Yuan Du, Shanghang Zhang
    18764-18772
    2026-03-14
  • Enhance Vision-Language Alignment with Noise

    Sida Huang, Hongyuan Zhang, Xuelong Li
    17449-17457
    2025-04-11
  • Vision-aware Multimodal Prompt Tuning for Uploadable Multi-source Few-shot Domain Adaptation

    Kuanghong Liu, Jin Wang, Kangjian He, Dan Xu, Xuejie Zhang
    18897-18905
    2025-04-11
  • Landsat30-AU: A Vision-Language Dataset for Australian Landsat Imagery

    Sai Ma, Zhuang Li, John A. Taylor
    7809-7817
    2026-03-14
  • MetaGPT: A Large Vision-Language Model for Meme Metaphor Understanding

    Bo Xu, Chenyuan Wang, Xinyu Chen, Hongfei Lin, Feng Xia
    16040-16048
    2026-03-14
  • A Dynamic GCN with Cross-Representation Distillation for Event-Based Learning

    Yongjian Deng, Hao Chen, Youfu Li
    1492-1500
    2024-03-24
  • SurgPub-Video: A Comprehensive Surgical Video Framework for Enhanced Surgical Intelligence in Vision-Language Model

    Yaoqian Li, Xikai Yang, Dunyuan Xu, Yang YU, Litao Zhao, Xiaowei Hu, Jinpeng Li, Pheng-Ann Heng
    6628-6635
    2026-03-14
  • Wasserstein Distance Constraint and Parameter Sparsification for Batched and Iterative Knowledge Editing

    Shanbao Qiao, Xuebing Liu, Seung-Hoon Na
    25019-25028
    2025-04-11
  • DeepHit: A Deep Learning Approach to Survival Analysis With Competing Risks

    Changhee Lee, William Zame, Jinsung Yoon, Mihaela van der Schaar
    2018-04-26
  • Markov Decision Processes with Time-Varying Geometric Discounting

    Jiarui Gan, Annika Hennes, Rupak Majumdar, Debmalya Mandal, Goran Radanovic
    11980-11988
    2023-06-26
  • Hypercorrelation Evolution for Video Class-Incremental Learning

    Sen Liang, Kai Zhu, Wei Zhai, Zhiheng Liu, Yang Cao
    3315-3323
    2024-03-24
1126 - 1150 of 14874 items << < 41 42 43 44 45 46 47 48 49 50 > >> 

Information

  • For Readers
  • For Authors
  • For Librarians
  • Part of the
    PKP Publishing Services Network

Copyright © 2024, Association for the Advancement of Artificial Intelligence

More information about the publishing system, Platform and Workflow by OJS/PKP.