Nicholas Carlini による敵対的サンプル論文リストの継続版です。2025-09-15 以降に arXiv に投稿された論文を対象としています。元のリスト(13,697 件)で学習した TF-IDF + ロジスティック回帰の分類器(ホールドアウト AUC 0.998)でスコアが 40% 以上の論文を掲載し、arXiv ID の年月ごとにまとめています。
総数: 3069 件
最終更新: 2026-10-01.


直近1か月
2026-09(251 件)
- [100%] Robustness Evaluation and Detection of Transferable Adversarial Attacks in ML-Based NIDS
Huda Ali Alatawi - [100%] Reinforcement Learning Inspired Black-box Adversarial Attacks for Computer Vision
Florian Krone; Elena Hoemann; Sven Hallerbach - [100%] GuidedRay: Diversity-Guided Direction Discovery for Targeted Hard-Label Black-Box Attacks
Fei Yuan; Yantian Shen; Qingyuan Yu; Yi Chen; Binghui Wang; Hongbo Yu; Anyu Wang; Xiaoyun Wang - [100%] One Attack to Fool Them All: Highly Transferable Black-Box Adversarial Attacks on Frontier MLLMs
Sen Nie; Jie Zhang; Zhongqi Wang; Shiguang Shan; Xilin Chen - [99%] StyleAT: Defending Face Recognition Against Semantic Attacks
Ben Shapira; Roi Cohen; Shang-Tse Chen; Mahmood Sharif - [99%] Breaking Windows Malware Detection: A Comprehensive Evaluation of Problem-Space Adversarial Robustness
Mashal Zainab; Salijona Dyrmishi; Hamid Bostani; Lorenzo Cavallaro; Maxime Cordy - [98%] Discovering Natural Transformation Vulnerabilities in Black-Box Vision Models
Dongsu Song; DaeYun GO; Jay Hoon Jung - [98%] Neither Adversarial Training Nor Purification: Emergent Adversarial Robustness from Oscillatory Predictive Learning
Mohammed-Yassine Habibi; Klea Ziu; Martin Takáč; Makoto Yamada - [98%] What Makes Adversarial Examples Transfer Across Deepfake Detectors?
Rafael M. Mamede; Pedro C. Neto; Ana F. Sequeira - [98%] Adversarial Attacks and Identity Leakage in De-Identification Systems: An Empirical Study
Felix Rosberg; Cristofer Englund; Eren Erdal Aksoy; Fernando Alonso-Fernandez - [98%] RAMP: Reversing Adversarial Perturbations to Strengthen Clean-Label Backdoor Attacks against Malware Detectors
Jinwen Xin; Dongni Zhang; Chenyang Wang; Jianming Fu; Ming Tang; Guojun Peng - [98%] AnchorRep: Defending LLMs Against Cross-Model Adversarial Transfer via Representation Repulsion
Gal Wertheizer; Rom Himelstein; Tomer Peretz; Avi Mendelson - [97%] Frame the adversary: a structure-aware attack methodology
Vicky Kouni; Stelios Perrakis; Francis Bach; Pascal Frossard; Yann Chevaleyre - [97%] Backdoor as Probe: Test-Time Adversarial Defense for CLIP
Zhongqi Wang; Jie Zhang; Nie Sen; Zhiyu Chen; Shiguang Shan; Xilin Chen - [96%] MROP: Mask-Region Optimized Purification Against Backdoor Attack in Deep JSCC
Seongkyu Yang; Hyeonho Noh; Hyun Jong Yang; Jonggyu Jang - [96%] Johnny Still Receives Spam SMS: Assessing the Robustness of SMS Spam Detection
Muhammad Salman; Muhammad Islam; Muhammad Ikram; Mohamed Ali Kaafar - [96%] Adversarial Vulnerabilities of Neural Biomarker Identification Systems
Polina Tapal; Bryce-Allen Bagley - [96%] Adversarial Training for Tabular Credit Scoring: A Multi-Attack Robustness Evaluation in P2P Lending
Gijs A. F. Niewzwaag; Marijn G. S. Veth; Manuele Massei; Marcos R. Machado - [96%] Admissable: Training Reinforcement Learning Agents against Adversarial Missingness
Paul Stahlhofen; Luca Hermes; Tim Kochs; Markus Vieth; Barbara Hammer - [96%] Region-Level Black-Box Defense Against Stealthy Embedding-Space Backdoors in CLIP
Ahmed Abdelnaby; Mohamed Elmahallawy - [96%] Universal Cross-Prompt Adversarial Attacks on Promptable Concept Segmentation
Ziqi Zhou; Yifan Hu; Yufei Song; Haowen Jiang; Xianlong Wang; Shengshan Hu; Dezhong Yao; Leo Yu Zhang - [95%] T-Backdoor: Exploiting Temporal Redundancy in Neuromorphic Data for Spike-preserving Backdoor Attacks on SNNs
Abdullah Arafat Miah; Kevin Vu; Yu Bi - [95%] Evasion Attacks on Cost-Utility-Based Adversarial Training for Online AutoML in IoT Networks
Chukwunonso Henry Nwokoye; Wajiha Zaheer; Khalil El-Khatib; Li Yang - [94%] Beyond Small Patches: Black-Box Detection and Purification of Diverse Backdoor Triggers
Ahmed Abdelnaby; Mohamed Elmahallawy - [94%] Preprocessing Failure and Adversarial Detection in Depthwise-Separable Edge Vision Systems
Jannatul Masruk Mukta; Rifa Sanjida; Adrita Rahman Tory; Md. Saifur Rahman; Khondokar Fida Hasan - [93%] InfraPatch: Cross-Task Targeted Grayscale Patch Attacks on Infrared-Adapted Vision-Language Models
Chengyin Hu; Dingyi Lu; Jiaju Han; Xiang Chen; Weiwen Shi; Jiahuan Long; Yiwei Wei; Jiujiang Guo - [93%] Kernel-Complexity Edge Sanitization for Training-Free Defense against Structural Graph Attacks
Yaning Jia; Shenyang Deng; Yaoqing Yang; Chiyu Ma; Wenxuan Xu; Soroush Vosoughi - [93%] Universal Defenses for Tool-Integrated LLM Agents Against Adversarial Attacks
Xiaoyan Li; Yunli Wang - [93%] Let the Carrier Carry the Attack: Preserving the Subject in Adversarial Image Generation
Linfeng Jiang; Steven McDonagh; Yuhang Chen; Xingyu Zhao; Siddartha Khastgir; Andi Zhang - [93%] Probabilistic Adversarial Training
Andi Zhang; Xingyu Zhao; Siddartha Khastgir - [92%] A GAN-Based Framework for Robust DDoS Attack Detection
Makram Chehayeb; Walid Fahs; Amina Rizk; Rida Khatoun; Omran Berjawi - [92%] CASCADE Against Jailbreaks: Combination Across Stages with Controlled Attack-Defense Evaluation
Jiale Luo; Eric Han - [92%] Probabilistic Robustness-driven Universal Adversarial Perturbations with Explainability against Deep Reinforcement Learning-based Intrusion Detection System
Hongsen Zhang; Lu Zhang; Mingjing Xu; Yi Zhang; Gregory Epiphaniou; Carsten Maple - [91%] A Black-Box Adversarial Attack on Human Pose Estimation and Keypoint-Based Action Recognition Models
Kacper Mroczek; Michal Kepski - [90%] InceptionRAG: Stealthy Poisoning Attack Against Retrieval-Augmented Generation
Jiachang Zhang; Min Chen; Xiao Ren; Zhenyong Zhang; Yuanchao Shu; Yunjun Gao; Zhikun Zhang - [90%] Contagion on the Trading Floor: How Adversarial Signals Spread in Multi-Agent Trading Systems
Qi Rong Sua; Junhao Dong; Nguyen Duc Thai; Yuqing Wen; Cheston Tan; Yew-Soon Ong - [90%] Psychoacoustically Aligned Latent Smoothing for Adversarial Robustness of Full-Duplex Speech-to-Speech Dialogue Models
Kian Shamsaie; Iman Modarressi - [90%] Can Attack Difficulty Be Characterized Before Optimization? A Study of Pre-optimization Difficulty in Person-Vanishing Attacks
Jingyao Xu; Dongdong Wang; Siyang Lu - [89%] Certifying Lower Bounds for Risk-Sensitive Reinforcement Learning under Adversarial State Perturbations
Tong Li; Saunak Kumar Panda; Yisha Xiang - [89%] ZeroGAR: Benchmarking the Adversarial Robustness of Zero-Shot Graph Models
Zhongjian Zhang; Xiao Wang; Busheng Zhang; Bo Yan; Xingtong Yu; Yue Gao; Jia Li; Chuan Shi - [88%] Does Reasoning Mitigate Backdoor Attacks? A Neuro-Symbolic Perspective
Marco Antonio Corallo; Andrea Agiollo; Mauro Conti; Alberto Giaretta - [88%] CrACK: Adversarial Attacks on Cross-Model Consistency in Collaborative Vision Foundation Models
Feifei Liu; Jintao Cheng; Chi Man Vong; Xiaoyu Tang - [88%] Pick Your Poison: Learning to Select Poison Sets for Stronger LLM Backdoor Attacks
Aashiq Muhamed; Mona T. Diab; Virginia Smith; Andrew Ilyas; Matthew Jagielski - [88%] Brenier Meets Adversarial Training: Optimal Transport Geometry for Robust Learning
Alireza Abdollahpoorrostam; Ehsan Sharifian; Buse Åen; Marco Cuturi; Daniel Kuhn - [87%] Weaponizing Ground Truth: Data Poisoning Attacks by Exploiting Boundary Misalignment Between Antivirus Software and Learning-Based Detectors
Jieshuai Yang; Zhi Wang; Yan Jia; Zhenhua Wu; Jianfei Tang; Chenbin Su; Jingwei Ye; Jianwen Tian; Wanpeng Li - [87%] Detection of Adversarial Attacks on Super-Resolvers Using Spectral Features
Emma J. Reid; Haley Duba-Sullivan; Tony G. Allen - [86%] Weeding Out Bad Seeds: Initial-Noise-Robust Unlearning for Text-to-Image Diffusion Models
Arian Komaei Koma; Seyed Amir Kasaei; Aida Aryafar; Matin Ghiasi; Ali Aghayari; Amirhossein Souri; Mohammad Mosayyebi; AmirMahdi Sadeghzadeh; Mohammad Hossein Rohban - [85%] Forbid Your Attention: Fooling Multimodal Large Language Models by Selectively Removing Intrinsic Focus in Spectral Domain
Daizong Liu; Junhao Dong; Zhiyuan Ma; Xiaoye Qu; Xiang Fang; Runwei Guan; Keke Tang; Jianfeng Dong; Yew-Soon Ong - [85%] Robust Policy Optimization via Adversarial Importance Sampling
Amine Andam; Jamal Bentahar; Mustapha Hedabou - [84%] PhantomCall: Evading ML Malware Detectors via Function Call Graph Perturbation
Md Ajwad Akil; Adrian Shuai Li; Imtiaz Karim; Arun Iyengar; Ashish Kundu; Elisa Bertino - [84%] Poisoning Attacks on the PGM-index
Atsuki Sato; Martin Aumüller; Yusuke Matsui - [84%] AlcaTRAz – Anchored Tree-Rule Defense Against Jailbreaks
Jakub Reš; Petr Kaška; Martin Perešíni; Martin Ukrop; Kamil Malinka - [84%] Towards a Resilience-Theoretic Foundation for Adversarial Robustness in Industrial Control System Anomaly Detection
Branka Stojanović; Andreas Flatscher; Michael Somma - [84%] JevAdvBench: A Benchmark and Black-Box Attacks for Reinforcement Learning for Calibrated Decisions Models
Jianyi Hu; Hangtao Zhang; Yi Liu; Yeqi Zeng; Li Zeng; Xianlong Wang; Rui Wang; Leo Yu Zhang - [84%] LogiC-Diff: Embedding Security Properties Into AI-Enabled Cyber-Physical Systems
Ziyan An; John Stankovic; Meiyi Ma - [83%] Empirical Evaluation of Data Poisoning Attacks in Supervised Learning
Toshif Khan; Muhammad Abusaqer - [83%] When Clients Are Orchestrated: Strategic Gradient Manipulation to Defeat Federated Learning Servers with Efficient Defense
Mohamed Shaaban; Ahmed Abdelnaby; Mohamed Elmahallawy - [83%] Guard Models Are Overconfident Where Base Models Are Uncertain
Jonghyun Hong; MinJae Jung; Minwoo Kim - [83%] Exploiting Vulnerabilities: Universal Adversarial Attacks on Vision-Language-Action Models in Robotics
Songhua Yang; Ziyu Liu; Yuanwei Liu; Xuetao Li; Xuanye Fei; He Huang; Zheng Wang; Miao Li - [82%] Breadth Beats Depth: Improving GCG-Based Jailbreak Optimization with Breadth-Oriented Suffix Search
Shiliang Xiao; Jingsong Wei; Yuzhi Liang; Yufan Zheng; Xia Li; Qiliang Lin - [82%] FreqDoor: A Hidden Trojan in the Frequency Domain for Backdoor Attacks on Vision-Language Models
Yasir Arafat Prodhan; Sadad Hasan; Mohammed Imamul Hassan Bhuiyan - [82%] Robust Adversarial Reinforcement Learning with Risk Sensitivity and Critic Consistency Regularization
Jiaxi Wu; Tiantian Zhang; Yuxing Wang; Yongzhe Chang; Xueqian Wang - [82%] Why Backdooring Neural Networks is so Easy?
Issam Seddik; Mohamed El Amine Seddik - [82%] Render Before Reading: Visual Rendering as a Prompt Injection Defense
Jie Zhang; Andrei Baroian; Jan N. van Rijn; Avital Shafran; Florian Tramèr - [81%] Investigating Adversarial Robustness of Heterogeneous Cooperative Perception
Chenyi Wang; Yutong Liu; Qingzhao Zhang; Ming F. Li - [81%] SoK: Trading Agents or Market Crashers? Dissecting Robustness and Security Failures in Academic Financial LLM Trading Schemes
Mengxiao Wang; Nitesh Saxena - [80%] ODPure: Backdoor Purification for Object Detection via Ensemble Corruption Consensus
Li Zeng; Mingcheng Duan; Longfei Fan; Hangtao Zhang; Xianlong Wang; Yanchun Li; Xia Wen; Leo Yu Zhang - [80%] Can Pixels Alone Reveal Image Origin? Minimax Limits and Learnable Interfaces for Passive Provenance
Kai Yao - [79%] A Unified and Constrained View of Regularization-Based Robust Reinforcement Learning
Amine Andam; Jamal Bentahar; Mustapha Hedabou - [79%] It Takes Little to Rewrite Perception: Targeted Semantic Substitution in Vision-Language Models at $ε\leq 4/255$
Binchi Zhang; Atrisha Sarkar; Apurva Narayan - [78%] VerTox: Verifiable Reward-Guided Corpus Poisoning Against Neural Ranking Models
Zhiqi Huang; Vivek Datla; Zhichao Xu; Puxuan Yu; Vivek Srikumar; Alfy Samuel - [78%] SEAL: Reinforcing Global Safety in Mixture-of-Experts through Shared Expert ALignment
Qingyu Meng; Yiwei Zha; Jiahuan Pei; Koen Hindriks; Herbert Bos; Min Chen - [78%] Certifying Adversarial Robustness of Quantum Classifiers under Known-Readout Query Access
Ji Guan; Mingyu Huang - [78%] End-to-End Hard-Label Cryptanalytic Model Extraction Using Efficient Sign Recovery
Akira Ito; Takayuki Miura; Yosuke Todo - [77%] CodePoisonRAG: Knowledge Poisoning Attacks on Retrieval-Augmented Code Generation
Varun Gadey; Ziad Marey; Alexandra Dmitrienko - [77%] Exploring Solver-Level Warmstarting for Neural Network Verification
Annelot Bosman; Minghao Liu; Marta Kwiatkowska; Holger Hoos; Jan van Rijn - [77%] WARP: A Unified Benchmark for Invisible Image Watermarking — Robustness and Protection Against Attacks
Khaled Abud; Aleksey Yakushev; Aleksandr Akimenkov; Irina Serzhenko; Kirill Aistov; Egor Kovalev; Dmitry Obydenkov; Sergey Lavrushkin; Anastasia Antsiferova; Dmitriy Vatolin; Yury Markin; Kirill Lukianov - [76%] Fine-grained Distributed Backdoor Attacks in Federated Learning
Jian Wang; Hong Shen; Wei Ke; Xue Hua Liu - [76%] Robust Workflow Generation via Adversarial Learning for Audio Deepfake Detection
Xiang Li; Pin-Yu Chen; Wenqi Wei - [76%] DeMark: A Query-Free Black-Box Attack for Quality-Preserving Audio Watermark Removal
Weikang Ding; Binhao Ma; Hanqing Guo; Rui Duan - [75%] Decoding Guardrails: XAI-Guided Perturbation Analysis of Prompt Injection Detection
Fernando Outeda; Gustavo Betarte; Juan Diego Campo; Fiorella Cravero - [74%] Repeat-After-Me: Black-Box Adaptive Visual Prompt Injection
Sizhe Chen; Yu-Lin Tsai; Ivan Evtimov; Kamalika Chaudhuri; Raluca Ada Popa; David Wagner; Arman Zharmagambetov - [74%] Stealthy in Semantics, Antagonistic in Space: Attacking Visible-Infrared Object Detectors via Object-Level Misalignment
Yueqi Zhu; Qi Ming; Guo Cheng; Yongkang Zhang; Feiran Liu; Juan Fang; Jiahuan Zhou; Jiangmeng Li; Yuhan Zhang - [73%] SoK: Privacy Attacks on Machine Learning via Explainable AI
Abdullah Caglar Oksuz; Anisa Halimi; Erman Ayday - [73%] Red-Teaming Auto Mode: Improving Blocking Classifiers Against Malign Coding Agents
Alex Remedios; Simon Storf; Fabien Roger; John Hughes - [72%] Windows Malware Detector as a Compound AI System: Trade-Offs in Accuracy, Efficiency, and Adversarial Robustness
Andrea Ponte; Luca Demetrio; Luca Oneto; Battista Biggio; Fabio Roli - [72%] SteerProbe: Learning to Bypass Safety Steering in Vision-Language Models
Xinwei Zhang; Aoting Hu; Hangcheng Liu; Shuchao Pang; Qingqing Ye; Haibo Hu - [71%] AERIAL: Adversarial Evaluation of Robustness in Accuracy-Preserving Low-Precision EEG Decoders
Saim Rehman; Muhammad Shafique - [71%] Typographic Attack Against VLM-based AI-generated Image Detection
Eunmin Lee; Jungwoo Kim; Jong-Seok Lee - [71%] Security Properties of Neural Networks as Decision Problems
Adrian Wurm - [70%] TRIS: A Tri-Layer Retrieval Integrity Sieve Against Knowledge Poisoning
Muhaimin Bin Munir; Akib Jawad Ononto; Nazia Shehnaz Joynab; Bhavani Thuraisingham; Latifur Khan - [70%] SoK: Rethinking Jailbreaking in the Era of Agentic AI: Attacks, Defenses, and Practical Consideration
Md Jueal Mia; Yanzhao Wu; Selcuk Uluagac; M. Hadi Amini - [70%] ViTeGate: Visual-Textual Triggered Knowledge Poisoning for Vision-Language Retrieval-Augmented Generation
Xue Tan; Xuandi Zeng; Yu Shao; Zhongli Fang; Mingyu Luo; Xiaoyan Sun; Ping Chen; Jun Dai - [70%] Prefilling the Reasoning Channel: Output-Prefix Attacks on Reasoning LLMs
Lukáš Brůna; Robert Bridges; Adam Ek - [70%] TrackFlood: Relocating Latency Attacks from NMS-Free Detectors to Real-Time Trackers
Zonghua Gu; Julian Singh-Smith; Junlin Liao; Di Liu; Amin Saremi - [69%] MUGEN: Generating Unlearnable Graph Examples for Multiple Learning Tasks
Ziyan Liu; Chengshuai Zhao; Huan Liu - [69%] Detecting and Localizing Segment-Level Poisoning in Multi-Source LLM-Agent Inputs
Xue Tan; Changhui Wang; Sanrui Yang; Hao Luan; Zhuyang Yu; Jin Wei; Ping Chen; Xiaoyan Sun; Jun Dai - [69%] BRFID: Toward Byzantine-Robust Federated Intrusion Detection
Asmah Muallem; Firdous Kausar; Sajid Hussain; Lei Qian - [69%] VirusCascade: Hijacking Collaborative Reflection in LLM-Powered Recommender Agents
Yurong Hao; Wen Zhou; Guowei Guan; Tiantong Wu; Fuyao Zhang; Wei Yang Bryan Lim - [69%] Anchoring Adversarial Trajectories to Data Manifolds: A Bilevel Transfer Optimization Framework
Yaohua Liu; Yifan Guo; Jiaxin Gao - [69%] BadAction: Backdoor Attacks on Interactive Video Generation via Action-Guided Triggers
Zhihang Wu; Zhongqi Wang; Jie Zhang; Fengming Gu; Shiguang Shan; Xilin Chen - [68%] GateDrain: Availability Attacks and Admission-Side Defense for Confidence-Gated Edge-Cloud Inference
Zonghua Gu; Julian Singh-Smith; Junlin Liao; Di Liu - [68%] Let the Neurons Die: Exploiting ReLU-Induced Model Degradation
Kexin Li; Wenjun Qiu; Joshua Abraham; Aditi Maheshwari; David Lie - [67%] AKRASIA: Stealthy Backdoor Attack on Reasoning-based Code LLMs
Chua Jin Chou; Sarang Nambiar; Murali Srinivasan; Ezekiel Soremekun - [67%] MarkSec: Capability-Aware Evaluation of Adversarial Attacks Against LLM Watermarks
Kairong Li; Zhikun Zhang; Xiao Ren; Yunjun Gao - [67%] Deep Learning Latency Attacks and Defenses: A Cross-Domain Survey of Availability Threats
Zonghua Gu; Zeyu Gao; Amin Saremi; Samarjit Chakraborty - [67%] Dagger: Decoupling-based Model Stealing Attack against Graph Neural Networks
Ying Song; Xiaowei Jia; Balaji Palanisamy - [67%] SceneJail: Exploiting Video Scenario Context to Jailbreak Multimodal LLMs
Wenyu Chen; Li Wang; Chuanchao Zang; Xiangtao Meng; Xinyu Gao; Jianing Wang; Zheng Li; Shanqing Guo - [66%] Rethinking Backdoor Repair Evaluation: Distinguishing Aggregate Clean Utility from Benign Performance Preservation
Baogang Song; Changtian Song; Jian Chen; Fan He; Junwei Zhou; Jianwen Xiang; Dongdong Zhao - [66%] TraceGuard: Adaptive Multimodal Poison Filtering through Cross-Feature Rank Agreement
Haoyang Li; Yaxin Xiao; Linyan Dai; Jiawen Fu; Zi Liang; Jason Xue; Qingqing Ye; Haibo Hu - [65%] Bait-and-Recover: Poisoning Internal Refusal Signals to Defend LLMs against White-Box Editing Jailbreaks
Tian Gao; Zhipeng Xie; Yuhao Wu; Junhua Liu; Xin Fang - [65%] A TTP by TTP Approach: Precise Malware Detection via Malicious TTP Recognition
Yashovardhan Sharma - [65%] Evaluating the Semantic-to-Geometric Gap in Adversarial Defenses Against Vision-Language Model-Based Plagiarism
Christopher Burger; Christina Trotter; Joseph Carlisle; Charles Walter - [65%] LEAP-CBF: A Safety Filter for Uncertain Systems with Least-Effort Adversarial Potentials
Oswin So; Eric Yu; Chuchu Fan - [64%] Do Input-Level Defenses Transfer to Observation-Level Attacks on VideoLLMs?
Bangshuo Zhu; Wei Song; Yuxin Cao; Yuezhong Wu; Zhiquan Liu; Yuekang Li; Jingling Xue - [64%] ASGARD: Action-Space Guard for UAV Resilience via Reinforcement Learning
Mohsen Salehi; Karthik Pattabiraman - [63%] Illusion of Depth: Revealing Hidden Stereo Vision Vulnerabilities in Depth Estimation
Sri Hrushikesh Varma Bhupathiraju; Tetsu Ishizue; Nicholas U. Costagliola; Ozora Sako; Kentaro Yoshioka; Takeshi Sugawara; Sara Rampazzi - [63%] The Vulnerability of Neural Audio Watermarks under Speech Enhancement
Xincong Zhong; Shengyao Wang; Lingfeng Yao; Yihang Bao; Jinze Yu; Miao Pan; Jiang Liu - [62%] SAFEGuard: Detect Optimization-Based Jailbreak Attacks Through Harmful Semantic Analysis and Fluency Measurement
Quoc Viet Vo; Trung Le; Damith C. Ranasinghe; Ehsan Abbasnejad - [62%] Similarity Is Not Validity: Defending LLM Semantic Caches Against Poisoning
Zihan Zhang; Shuangjie Yao; Zesen Liu; Zhixiang Zhang; Wai Ip Lai; Dung Hiu Hilton Yeung; Chun Kit Zhang; Fuchen Ma; Yuanyuan Yuan; Yu Jiang; Dongdong She - [61%] Towards One-for-All Robustness Across a Continuum of Threat Levels
Zhichao Hou; Xiaorui Liu - [61%] Robust Dynamic Expansion for Continual Learning under Backdoor Attacks via Purification and Selective Recovery
Keyu Lin; Fei Ye; Qihe Liu; Shijie Zhou; Jiguo Yu - [61%] Adversarial Testing of Automated Program Repair Agents for Security Vulnerabilities
Fares Trad; Simin Chen; Hung Viet Pham; Gias Uddin; Baishakhi Ray - [61%] Competition, Collusion, and Corruption: The Spectrum of MEV Attacks on DAG-Based BFT Consensus Protocols
Iliya Mirzaei; Heer Patel; Chenyuan Wu; Mohammad Javad Amiri - [61%] Micro-Collaborative Poisoning: A Distributed Attack on RAG Systems
Pedro Pereira; Eva Maia; Isabel Praça - [61%] FeatMark: Feature-level Watermark Protection against Mimicry Attacks with Diffusion Models
Haoyang Li; Ruoxi Sun; Qingqing Ye; Benjamin Zi Hao Zhao; Yaxin Xiao; Jason Xue; Haibo Hu - [61%] ORBIT: A Framework for Multi-Agent Safety and Security Evaluations
Ben Hagag; William L. Anderson; Srija Chakraborty; Christian Schroeder de Witt - [61%] Backdoors Leave Structural Traces: FedMAST for Backdoor Detection and Containment in Federated Learning
Srinivasan Subramanian; Md. Abdullah Al Hafiz Khan; Kazi Aminul Islam - [61%] Feature-Aware Token Attack for Compression-Triggered Stealthy Failures in Large Vision-Language Models
Shilinlu Yan; Bowen Chen; Yuechen Zhang; Zhenhong Zhou; Li Sun; Sen Su - [60%] Does Deeper Reasoning Compromise Alignment? Revealing and Mitigating of Alignment Collapse in Large Reasoning Models
Yu-Hang Wu; Yu-Jie Xiong; Henghua Zhang; Bairui Zhang; Jia-Chen Zhang; Shaohua Li - [60%] Arbitrary Cipher Attacks Against Large Language Models Do Not Require Fine-Tuning
Thomas Rivasseau - [60%] On Identifying Adversarial Intent Injection in AI-Native 6G Networks
Nilesh Chakraborty; Petar Djukic; Burak Kantarci - [60%] Benchmarking Factual Robustness of LLMs via Multi-conversation Persuasion
Zhuoang Cai - [60%] MADBench: Benchmarking the Security of Multi-Agent Debate
Yuwan Liu; Jiaming Zhang; Yue Huang; Sisi Duan - [59%] Beyond Patch Removal: Persistent Adversarial Effects in Vision-Language-Action Policies
Enhao Wu; Fusen Guo; Yuxin Cao; Ziyang Lyu; Lin Li; Wei Song - [59%] Adversarially Robust PAC Learning with Optimal VC Rates
Steve Hanneke; Amirreza Shaeiri - [59%] CoDeL: Co-Evolutionary Defense against Indirect Prompt Injection in LLM-based Agents
Xiao Yang; Yangchen Ou; Yuhan Gao; Le Wang; Zonghao Ying; Aishan Liu - [59%] Still There, No Longer Seen: Exposing Compression-Induced Risk in Large Vision-Language Models
Qiankun Li; Yuechen Zhang; Bowen Chen; Shilinlu Yan; Zhenhong Zhou; Kun Wang; Li Sun - [59%] FinRT: Distilling Adaptive Red-Teaming Strategies into Reusable Adversarial Generators in Consumer Finance
Rikhiya Ghosh; Himanshu Kumar; Sriram Venkatapathy; Sahil Wadhwa; Alexandre G. R. Day; Pranab Mohanty - [58%] Fusing Spectral Signatures and Activation Clustering for Backdoor Detection in Healthcare Imaging Models: Method, Implementation, and Evaluation
Suresh Tamang - [58%] ALIBI: Adversarial Legitimacy Injection in Binary Input against LLM Malware Analyzers
Hyeongjun Choi; Wonyoung Jung; Haehoon Seo; Sungyup Nam - [58%] Divide and Doubt: Diverse Distributed Poisoning for Retrieval-Augmented Generation
Tianhao Chen; Yuhan Wei; Weifei Jin; Zhengyuan Jiang; Yuepeng Hu; Neil Zhenqiang Gong - [57%] MechAudit-40: White-Box Auditing across 40 LLM Attack Mechanisms
Zhen Guo; Shanghao Shi; Shamim Yazdani; Ning Zhang; Reza Tourani - [57%] Decoy Direction Optimization: A Post-Hoc Defense Against LLM Abliteration
Aashiq Muhamed; Mona T. Diab; Virginia Smith - [57%] AgentXploit: Autonomous Repository-to-Runtime Red-Teaming for AI Agents
Weida Liang; Shi Qiu; Zhun Wang; Simon Sure; Xiaoyuan Liu; Tianneng Shi; Zhaorun Chen; Wenbo Guo; Dawn Song - [57%] Information Blackhole: Exploring Backdoor Mechanism in 3D Point Cloud Reconstruction
Zhifei Yang; Xiuping Liu; Kuofeng Gao; Junkai Qiu; Meng Liu; Yuhao Bian - [57%] CounterSteer: Suppressing Indirect Prompt Injection with Activation Steering
Mark Russinovich - [56%] CoRL: Co-Evolutionary Reinforcement Learning for Adaptive Indirect Prompt-Injection Attacks and Defenses
Boyang Zhang; Qingxin Xiao; Lingwei Dang; Qingyao Wu - [56%] Sparsity-Adaptive Sharpness-Aware Minimization
Shiryu Ueno; Yoshikazu Hayashi; Kunihito Kato - [56%] Reflections on Trusting Trust, Revisited: Contaminating Self-Modifying AI Coding Agents with Poisoned Benchmarks
Franziska Roesner; Tadayoshi Kohno - [56%] Robust to Which Model Change? A Unified Evaluation of Robust Counterfactual Explanations
Marcin Kostrzewa; Maciej ZiÄba - [56%] Adversarial Debiasing of Machine Learning Models for Enhanced Network Security against DDoS Attacks
Aadith Sukumar; Isha Singh; Devershika Mohane; Ankit Mukherjee; Ankush Dutta; Rahee Walambe; Ketan Kotecha - [55%] Leveraging Imperfect Restoration for Data Availability Attack
Yi Huang; Jeremy Styborski; Mingzhi Lyu; Fan Wang; Adams Kong - [55%] Multimodal Resource-Exhaustion Attacks on Vision-Language Models via Joint Pixel-Prompt Optimization
Zhaoxiong Ni; Yatie Xiao; Chi-Man Pun; Fei Peng; Qingxiao Guan; Keke Tang - [55%] Robust Industrial Cyber Physical Classification Using Neuromorphic Temporal Embeddings and Hybrid SNN XGBoost Under Machine Unlearning Attacks
Ammar Kamoona; Sajad Koushkbaghi; Mahdi Jalili; Peter McTaggart; Xinghuo Yu - [55%] AGENTQ: Quantization-Conditioned Backdoor Attacks on LLM Agents
Xiaoqun Liu; Qiben Yan - [55%] Escaping Alignment: A Physical Trap Model of Best-of-N Jailbreaking
Marco Biroli - [54%] Jailbreaking Text-to-Image Models Through Cracks: Navigating Heterogeneous Safety Filters via Multi-Agent Debate
Kaiyan Wen; Shijie Zhang; Lu Yu; Guangdong Bai - [54%] Silent Failures in Agentic Security Evaluation: A Validated Harness for Tool-Call Mediation Under Indirect Prompt Injection
Animesh Shaw - [54%] Distillation Defenses Easily Break After Reinforcement Learning
Shidan Javaheri; Alexander Panfilov; Oliver Britton; Yarin Gal; Yonatan Gideoni - [54%] Learning Normal Diffusion Dynamics for Backdoor Defense in Text-to-Image Models
Junjian Li; Xiaolong Liu; Peng Sun; Liantao Wu; Linghan Chen; Yudong Gao; Honglong Chen - [53%] Privacy, Robustness, and Fairness Trade-offs in Federated Intrusion Detection: Geometric Indistinguishability at the Aggregation Interface
Adrita Rahman Tory; ABM Shawkat Ali; Md Abu Layek; Khondokar Fida Hasan - [52%] Context Inference Attacks Without Jailbreaks
Prince Jha; Samuele Poppi; Nils Lukas - [52%] Cryptanalytic Extraction of Neural Networks Without Known Architecture Assumption
Yantian Shen; Yi Chen; Anyu Wang; Hongbo Yu; Xiaoyun Wang - [52%] PIDS-Bench: Evaluating Prompt-Injection Detectors Under Over-Defense, Obfuscation, and Distribution Shift
Yusuf Khalid Shire; Sang-Chul Kim - [52%] RAG-NAROK: Retrieval-Aware Knowledge Corpus Poisoning in RAG with Source-specific Refutation
Abdullahil Kafi; Alvi Ataur Khalil - [52%] MMSkillRisk: Can Agents Stay Safe When Multimodal Skills Become Traps?
Lingqi Jiang; Jialuo Chen; Jianan Ma; Xinhao Deng; Xiaohu Du; Sibo Yi; Yuqi Qing; Zhenguang Liu; Qinming He; Shiwen Cui; Changhua Men - [52%] Inference-Layer Security: Defending Against Adversarial Inference and Infrastructure Abuse
Keifer Lee - [51%] When Optimization Becomes Manipulation: Defending Generative Search against Malicious Generative Engine Optimization
Haozhang Li; Yangguang Shao; Xinjie Lin; Zhong Guan; Mi Zhou; Junzheng Shi - [51%] A Robust Watermark-based Fingerprint Framework for GNNs Ownership Verification
Han Zhang; Yan Wang; Guanfeng Liu; Pengfei Ding; Huaxiong Wang; Kwok-Yan Lam - [51%] RISK: Auditing Industrial Control Systems for Too-Late-to-Recover Vulnerabilities
Syed Ghazanfar Abbas; Gang Wang; Dongyan Xu - [50%] Privacy Leakage in Federated Learning: Gradient-Based Client Identity Inference and Defenses for Inertial Sensing in Vehicular Edge Networks
Ali Akarma; Toqeer Ali Syed; Muhammad Khan; Qurat-ul-ain Mastoi; Adeel Ahmad - [50%] Extracting Forgotten Prompts from Targeted Unlearned Models
Au Ashley Hoi-Ting; Meghdad Kurmanji; William F. Shen; Nicholas D. Lane; Ligang He - [50%] Lightweight Detection of Electromagnetic Signal Injection Attacks on Image Sensors
Youqian Zhang; Chunxi Yang; Eugene Yujun Fu; Sze Yiu Chau; Haibo Hu; Xiapu Luo - [50%] ACEA: An Adversarial Co-Evolution Arena for Head-to-Head Red-Team and Blue-Team LLM Testing
Yi Ting Shen; Kentaroh Toyoda; Alex Leung - [50%] The Price of Safety: Benign-Case Utility and Token Overhead of Memory-Poisoning Defenses in LLM Agents
Pritom Bhowmik - [50%] Median Temporal Ensembling: Training-Free Robust Aggregation for Action-Chunked Visuomotor Policies
Yuhang Jiang - [50%] Finite-Sample Probabilistic Safety Certification for AI-Based Grid-Edge Coordination
Yihong Zhou; Hanbin Yang; Thomas Morstyn - [50%] Do Electromagnetic Side-Channel Attacks Threaten Electronic Polling Stations? Scenarios and Recommendations
Lucas Brito; Leonardo Teodoro; Pedro Tomaz; Alyson Isaluski; Leandro Hyeda; Antonio Oliveira-Jr; Saulo Queiroz - [50%] Climbing the Hill: Prompt Injection Red-Teaming Against Frontier Models with Curriculum Reinforcement Learning
Chenlong Yin; Xiaolong Jin; Wei Zou; Yanting Wang; Jinyuan Jia - [50%] CodeMimicry: Exploiting Safety Generalization Lag in Large Language Models via Structured Code Completion
Zhen Liang; Hai Huang; Wentao Chen - [49%] Chypothermia: Clock Freezing for Static Side-channel Attacks
Fatemeh Khojasteh Dana; Mehmet Ali Cetin; Xinrui Wang; Andrew Butler; Yuval Yarom; Shahin Tajik - [49%] Ajar: Measuring Open Privilege in Agent Defenses
Reshabh K Sharma; Linxi Jiang; Shuo Chen; Zhiqiang Lin - [49%] Hidden Activations are not Enough I: Knowledge Matrices as Higher Representations
Marco Armenta - [49%] Self-Evolving Defense: Continual Security Policy Learning for LLM Agents
Minh Nhat Le; Nisarga Gondi; Yibo Peng; Ronghao Ni; Limin Jia; Beidi Chen; Haizhong Zheng - [48%] Certifying Concept Unlearning in Text-to-Image Diffusion Models
Mansi; Luca Marzari; Francesco Leofante - [48%] "Your Robot Was Trained on a Lie": Collision Mesh Poisoning Attacks on Robotic Manipulation
Gengyang Xu; Dongwei Xiao; Yiteng Peng; Yanbo Dai; Ruochen Zhou; Shing-Chi Cheung; Xiaoyu Ji; Wenyuan Xu; Shuai Wang - [48%] HE-Guardrail: A Homomorphic Guardrail Against Jailbreak Attacks for Encrypted Large Language Model Inference
Byeongseo Min; Yongwoo Lee; Young-Sik Kim; Yongjune Kim - [48%] Printability-Constrained Adversarial Decals for Near-Nadir Aerial Perception: Measured Ink Gamuts, Nested Realism Constraints, and a Physical-World Bound
Sandesh Shrestha; K. T. Yasas Mahima; Asanka G. Perera - [48%] Selective Channel Restoration for Backdoored Vision-Language Models
Shuming Liu; Zhifang Zhang; Suqin Yuan; Khin Mi Mi Aung; Zhuoyi Lin; Lei Feng - [47%] SISER: Speaker-Invariant Speech Emotion Recognition with Entropy-Based Adversarial Training
Eunseo Choi; Hyunku Kang; Chanwoo Kim - [47%] Poster: FedWM-Guard: Thwarting Imagination Poisoning in Federated World Model-based Autonomous Driving
Sheng Liu; Panos Papadimitratos - [47%] Prompt Injection Detection for Email Agents Through Attack Chain Modeling
Ahmad Hashmi; Dhyey Patel; Yunting Yin - [47%] Are Vision-Language-Action Models Robust to One-Step Observation Perturbations?
Shojiro Yamabe; Jun Sakuma - [47%] DecoyTrace: Toxic Decoys for Active Defense in Decentralized Federated Learning
Pedro Beltrán-López; Enrique Tomás MartÃnez Beltrán; Pantaleone Nespoli; Manuel Gil Pérez; Alberto Huertas Celdrán - [47%] The Geometry of Harmfulness in Multi-Turn Attacks
Yelyzaveta; Husieva; Lauren Alvarez - [47%] Interpretable but Fragile? Robustness of Concept Bottlenecks under Geometric-Semantic Perturbations
Hanwei Zhang; Tianma Hu; Gaojie Jin; Xu Cheng; Ronghui Mu - [46%] Inferring Hidden User Models from the Behavior of Personalized LLM Agents
Haoyang Li; Yaxin Xiao; Qingqing Ye; Huadi Zheng; Haibo Hu - [46%] Rethinking Indirect Prompt Injection as a Test-Time Search Problem
Duong M. Nguyen; Joon Sik Kim; Blazej Manczak; Vaikkunth Mugunthan - [46%] Automatic Red Teaming for Implicit Vulnerabilities of Text-to-Image Models
Chang Ma; Junlin Han; Shuo Chen; Runjia Li; Philip Torr; Jindong Gu - [46%] When Malicious Instructions Persist: Persistent Memory Poisoning Attack on Harness-Based Agents
Shuhuai Huang; Jingfeng Zhang; Hong Jia - [46%] CIG-MIA: Context-Induced Information Gain Membership Inference Attacks against Retrieval-Augmented Generation
Tan Xue; Huo Chang; Wang Changhui; Yang Sanrui; Li Heng; Chen Ping; Luo Xiapu - [46%] RAPID: A Real-Time Defense Against Unauthorized Model Distillation for Text-to-Image Services
Zihan Wang; Boheng Li; Rui Zhang; Wenshu Fan; Qingchuan Zhao; Tianwei Zhang; Hongwei Li; Guowen Xu - [46%] Co-Evolving Zero-Day Jamming: Adaptive Attack Synthesis and Graph Attention-Based Online Detection
Ghilas Aissou; Rémi A. Chou; Taejoon Kim - [46%] On the Gradient Heterogeneity Dynamics of Adversarially Robust Federated Regression
Leonardo F. Toso; James Anderson; Nirupam Gupta; Rafael Pinot - [46%] FairMean: Promoting Fairness in Distributed Learning under Label Poisoning Attacks
Huigan Zheng; Jiaojiao Zhang; Yongxiang Liu - [46%] NeuroRule: Making Black-Box Neural Networks Explainable through Rule-set Evolution
Tapaswini Kodavanti; Hormoz Shahrzad; Risto Miikkulainen - [46%] Safer Content or Firmer Refusals? A Hybrid Perturbation Defense for Alignment under Harmful Fine-tuning
Muhammad Zeeshan Akram; Mufid Kamel Marican; Anvesh Reddy Yenugu; Ali Zain Kaimkhani; Minghong Fang - [45%] From Detection to Refusal: Safer LLMs via Circuit-Guided Weight Scaling
Kuan-Lin Chu; Chung-En Sun; Tsui-Wei Weng - [45%] DART: Distributional Adversarial Recurrent Training for Algorithm Learning
Hieu Tran Bao; Phung Thanh Dang; Pham Quang Nhat Minh; Hoang Thanh Tung - [45%] Local Robustness Quantification for Naive Bayes Classifiers and Generative Forests: a General Approach
Adrián Detavernier; Jasper De Bock - [45%] Formally Modeling the Terrapin Attack on SSH
Jörg Schwenk; Fabian Bäumer; Marcus Brinkmann - [45%] LipSSM: Structurally Lipschitz-Bounded Cascaded State-Space Model via Metric Transfer between Consecutive SSM Layers
Natsuki Yoshino; Ren Uchida; Kazuki Matsumoto; Kohei Yatabe - [45%] Revisiting Certified Defense with Differential Privacy on Vision Transformers
Jun Yan; Weiquan Huang; Qixian Zhang; Yan Bai; Shutai Zhang - [45%] Backdoor Mitigation in Decentralized LLM Fine-Tuning
Sayan Biswas; Jade Garcia Bourrée; Rachid Guerraoui; Maxime Jacovella; Anne-Marie Kermarrec; Sathwika Peechara; Martijn de Vos; Milos Vujasinovic - [44%] SpecGuard: Inference-Time Backdoor Detection For Free
Rui Wen; Ahmed Salem; Andrew Paverd; Mark Russinovich; Zheng Li - [44%] The Misery of Mechanistic Interpretability: A Formal Perspective
Tobias Ladner; Matthias Althoff - [44%] On the Efficiency-Safety Dilemma in Large Reasoning Models
Yifei Yang; Zouying Cao; Xingrui Wang; Xiao Zhou; Yuexian Li; Dongjie Yang; Hai Zhao - [44%] When Consent Outlives Context: Residual Authority Replay in Long-Lived Agents
Zhihao Zhang; Chao Wang; Rujia Li; Qingze Wang; Xiaoyan Sun; Jun Dai - [44%] What Paired Evaluations Reveal under Visual Perturbations
Yongda Wei; Chen Zhang; Yifei Wang; Xinyu Wang; Bosen Shao; Hanxi Li; Liping Di - [43%] SRD-GUARD: A Defense Framework of LLMs via Semantic Rewriting and Joint Multi-Model Scoring for Latent Intent Exposure
Qi Wang; Chengcheng Wan; Jiangtao Wang - [43%] Kolmogorov–Arnold stability for discontinuous functions
Sviatoslav V. Dzhenzher - [43%] PDoS: A Profitable Denial-of-Service Attack against Proof-of-Work Blockchain Liveness
Junjie Hu; Tianzhu Han; Na Ruan - [43%] SENTINEL: A Multi-Pathway Architecture for Detecting Living-Off-the-Land APT Attacks on Windows Command Lines
Ahad Bin Islam Shoeb; Kamrul Hasan; Jamal Uddin Tanvin; Liang Hong; Imtiaz Ahmed; Md Arif Billah; Al Amin - [43%] Exploiting Software-level Abstractions To Support Practical Hardware Trojan Attacks
Athanasios Moschos; Kevin Valakuzhy; Georgios Kokolakis; Fabian Monrose; Angelos D. Keromytis - [43%] Learning Perturbation Robust Policies for LLM Agents with Stable Optimization
Pengxin Wang; Yuanzhe LI; Yuxin Ren; Huanrui Yang; Jingdi Chen - [43%] Byzantine-Robust Federated Representation Learning
Leonardo F. Toso; James Anderson; Rafael Pinot; Nirupam Gupta - [43%] Beyond Local Linearity: Scale-Resolved Geometry of Learned Image Encoders
Jakub Szymkowiak; Wojtek PaÅubicki; Kamil Adamczewski - [42%] Optimizing Byzantine Node Placement in Decentralized Federated Learning
Edoardo Gabrielli; Gabriele Tolomei - [42%] Trust-But-Verify: Poisoning-Resilient Locally Private Graph Learning Protocols
Longzhu He; Li Sun; Hao Peng; Ruijie Wang; Raymond Chi-Wing Wong; Sen Su - [42%] Robust Decentralized Personalized Federated Learning via Prediction-Constrained Neighborhood Collaboration
Xiao Ma; Hong Shen; Hui Tian; Wenqi Lyu; Wei Ke - [42%] A Three-Axis Stress Test of LLM vs Classical ML for Network Intrusion Detection under Distribution Shift and Adversarial Evasion
Muhammad Ebad Atif; Muhammad Haider Ali - [42%] When the World Lies: Backdoor Attacks on Latent World Models for Downstream Control
Roberto Riaño; Gorka Abad; Stjepan Picek; Aitor Urbieta - [42%] Validating, Not Sampling: Region-Level Robustness of Vision-Language and Vision-Language-Action Models
Bogdan Aron; Christopher Brix; Benedikt Brückner; Yanghao Zhang; Panagiotis Kouvaros; Alessio Lomuscio - [42%] Learning Defensive Policies against Diverse Inference Attacks for Smart Meter Privacy
Ruichang Zhang; Mustafa A. Mustafa - [42%] FINN-Tro: Exploiting Verification Gaps in Dataflow Inference Accelerators
Qazi Arbab Ahmed; Suraj Karki; Thorsten Jungeblut - [42%] The Tokens Remember: When Tokenization Bypasses Knowledge Editing and Unlearning
Manit Baser; Aditya Nawal; Dinil Mon Divakaran; Mohan Gurusamy - [42%] Adversarial Training for Pixel Diffusion
Xin Lin; Zhifei Zhang; Yuqian Zhou; Haitian Zheng; Zhe Lin; Ming-Hsuan Yang; Truong Nguyen - [41%] DIVA: Exploiting Cross-Step Conditional Propagation for Visual Jailbreaks in Discrete Diffusion Vision-Language Models
Guorui Song; Runqing Tang; Jingye Zhang; Luyuan Zhang; Feice Huang; Cong Ray; Guocun Wang; Dake Zhong; Choo Sin Wai; Bingquan Dai; Chuming Wang; Tongxu Lin; Wanyu Guo; Haoqian Wang - [41%] Rethinking Software-Defined Networking Link Discovery with Dynamic Randomization
Mingming Chen; Teryl Taylor; Frederico Araujo; Benjamin E. Ujcich; Thomas La Porta; Trent Jaeger - [41%] The MAL Simulator: Cyber Operations Simulation based on Attack & Defense Graphs
Jakob Nyberg; Sandor Berglund; Andrei Buhaiu; Joakim Loxdal; Pontus Johnson; Mathias Ekstedt - [41%] Market Signal Injection: Adversarial Context Manipulation of LLM Pricing Agents
Dohun Lee; Hyunwoo Park - [41%] TERMon: Detecting Persistent Behavioral Threats in Edge AI via Hardware-Native Ternary Runtime Monitor
Arish Sateesan; Edlira Dushku - [41%] MDRC: A Deployable State-Recovery Defense for Traffic Signal Control under Sensor Corruption
Mingyuan Li; Chunyu Liu; Xiao Liu; Yanna Jiang; Guangsheng Yu; Xu Wang; Wei Ni; Ren Ping Liu - [41%] Decision Hijacking: Prompt Injection Attacks on Jev's Typed Probabilistic Decisions
Tiantong Wu; Wei Yang Bryan Lim - [41%] Does Adversarial Training Improve Generalization in Multi-View VLAs? Revealing and Mitigating View Collapse
Futa Waseda; Shuhei Kurita; Isao Echizen - [41%] VLM4Cluster: Benchmarking Deep Clustering In the Era of Vision-Language Pre-training
Yuanwei Hu; Bo Peng; Yuheng Jia; Xinting Hu; Yadan Luo; Wenjie Zhu - [41%] Compression Footprints as Security Signals for Model-Poisoning Defense in Federated Learning
Sachi Shome; William Eiers - [40%] NERVE Attacks: Breaking AI-Powered Brain-Computer Interfaces
Zahra Tarkhani; Georgios Akkogiounoglou; Lorena Qendro; Isabel Tscherniak; Anil Madhavapeddy - [40%] Signing the Transaction but Not the Decision: Whisper Attacks and a Binding Defense for AP2
Yedidel Louck; Amit Dvir; Ariel Stulman - [40%] Upholding Robustness in Federated Learning: Trends, Emerging Strategies, and Research Opportunities
Pravija Raj P; Ashish Gupta; Andrea Augello; Sajal K. Das
→ 全リストを見る