Research

Published
2026

Progressive Behavioral Drift through Compression Valleys in Large Language Models

Zhiyuan Xu, Stanislav Abaimov, Joseph Gardiner, Sana Belguith

Findings of the Association for Computational Linguistics: EMNLP 2026

Under review
2026

NeuronFuzz: Safety Neuron Guided Fuzzing for LLM Safety Evaluation

Zhiyuan Xu, Muhammad Firhard Roslan, Joseph Gardiner, Sana Belguith, Lichao Wu

arXiv preprint arXiv:2608.26222

Under review
2026

RouteHijack: Routing-Aware Attack on Mixture-of-Experts LLMs

Zhiyuan Xu, Joseph Gardiner, Sana Belguith, Lichao Wu

arXiv preprint arXiv:2605.02946

Published Best Paper Award
2026

Reasoning That Leaks, Fine-Tuning That Amplifies: Exposing the Hidden Threats of Chain-of-Thought Models

Zhiyuan Xu, Joseph Gardiner, Sana Belguith

21st ACM Asia Conference on Computer and Communications Security (ASIA CCS 2026)

Under review
2025

The Dark Deep Side of DeepSeek: Fine-Tuning Attacks against the Safety Alignment of CoT-Enabled Models

Zhiyuan Xu, Joseph Gardiner, Sana Belguith

arXiv preprint arXiv:2502.01225

Published
2025

Depth2Elevation: Scale Modulation with Depth Anything Model for Single-View Remote Sensing Image Height Estimation

Zhongcheng Hong, Tong Wu, Zhiyuan Xu, Wufan Zhao

IEEE Transactions on Geoscience and Remote Sensing