Visual Intelligence Open Access Editor-in-Chief: Prof. Yaonan Wang
Volume 3, 2025
Research | Open Access
Visual-guided human-object interaction detection
Published: 28 February 2026
2025, 3: 30
Research | Open Access
Benchmarking Drag★ for eye direction transformation and beyond
Published: 28 February 2026
2025, 3: 29
Research | Open Access
Towards reliable deepfake detection from uncertainty calibration perspective
Published: 28 February 2026
2025, 3: 28
Review | Open Access
Efficient multimodal large language models: a survey
Published: 28 February 2026
2025, 3: 27
Research | Open Access
GazeLLM: a plug-and-play zero-shot LLM reasoning framework for boosting gaze target detection
Published: 28 February 2026
2025, 3: 26
Research | Open Access
TVC: tokenized video compression with ultra-low bit rate
Published: 03 December 2025
2025, 3: 25
Research | Open Access
Large multimodal agents: a survey
Published: 03 December 2025
2025, 3: 24
Research | Open Access
ED2: environment dynamics decomposition world models for continuous control
Published: 03 December 2025
2025, 3: 23
Research | Open Access
DriveMLM: aligning multi-modal large language models with behavioral planning states for autonomous driving
Published: 03 December 2025
2025, 3: 22
Review | Open Access
A contemporary survey on image reconstruction with unsupervised deep learning: from denoising to generation
Published: 03 December 2025
2025, 3: 21
Research | Open Access
PS-Net: high-frequency attention and Bayesian analysis based facial pore segmentation with no human annotation
Published: 06 November 2025
2025, 3: 20
Research | Open Access
3MOS: a multi-source, multi-resolution, and multi-scene optical-SAR dataset with insights for multi-modal image matching
Published: 06 November 2025
2025, 3: 19
Research | Open Access
URNet: uncertainty-aware refinement network for event-based stereo depth estimation
Published: 06 November 2025
2025, 3: 18
Research | Open Access
Hybrid Fourier score distillation for efficient one image to 3D object generation
Published: 06 November 2025
2025, 3: 17
Research | Open Access
RefineFuse: an end-to-end network for multi-scale refinement fusion of multi-modality images
Published: 06 November 2025
2025, 3: 16
Review | Open Access
A survey of multimodal composite editing and retrieval
Published: 06 November 2025
2025, 3: 15
Research | Open Access
DASFormer: self-supervised pretraining for earthquake monitoring
Published: 06 November 2025
2025, 3: 14
Research | Open Access
CLFormer: a cross-lingual transformer framework for temporal forgery localization
Published: 06 November 2025
2025, 3: 13
Research | Open Access
Connecting dreams with visual brainstorming instruction
Published: 02 July 2025
2025, 3: 12
Research | Open Access
DehazeMamba: large multi-modal model guided single image dehazing via mamba
Published: 01 July 2025
2025, 3: 11
Research | Open Access
When SAM2 meets video camouflaged object segmentation: a comprehensive evaluation and adaptation
Published: 19 June 2025
2025, 3: 10
Research | Open Access
SHIELD: an evaluation benchmark for face spoofing and forgery detection with multimodal large language models
Published: 03 June 2025
2025, 3: 9
Research | Open Access
Pre-training on high-resolution X-ray images: an experimental study
Published: 28 May 2025
2025, 3: 8
Research | Open Access
DBDB: de-bimodal defocus blur in joint infrared-visible imaging
Published: 30 April 2025
2025, 3: 7
Research | Open Access
Uncertainty-aware coarse-to-fine alignment for text-image person retrieval
Published: 29 April 2025
2025, 3: 6
Review | Open Access
Immersive video interaction system: a survey
Published: 11 April 2025
2025, 3: 5
Research | Open Access
MIRSAM: multimodal vision-language segment anything model for infrared small target detection
Published: 02 April 2025
2025, 3: 4
Research | Open Access
Enhancing human-centered dynamic scene understanding via multiple LLMs collaborated reasoning
Published: 17 March 2025
2025, 3: 3
Research | Open Access
Efficient text-to-video retrieval via multi-modal multi-tagger derived pre-screening
Published: 06 March 2025
2025, 3: 2
Review
A survey on deep Learning for polyp segmentation: techniques, challenges and future trends
Published: 03 January 2025
2025, 3: 1