전체 AI 논문 - 2026-06-02

1. ClinEnv: An Interactive Multi-Stage Long Horizon EHR Environment for Agents


2. Tracking the Behavioral Trajectories of Adapting Agents


3. SafeSteer: Localized On-Policy Distillation for Efficient Safety Alignment


4. Bridging the Last Mile of Time Series Forecasting with LLM Agents


5. RASER: Recoverability-Aware Selective Escalation Router for Multi-Hop Question Answering


6. Iteris: Agentic Research Loops for Computational Mathematics


7. MCP-Persona: Benchmarking LLM Agents on Real-World Personal Applications via Environment Simulation


8. AGENTCL: Toward Rigorous Evaluation of Continual Learning in Language Agents


9. Beyond One-shot: AI Agents for Learning in Field Experiments


10. HLL: Can Agents Cross Humanity’s Last Line of Verification?


11. Food Noise & False Safety: A Systematic Evaluation of How LLMs Fail to Adapt to Eating Disorder Queries with Clinician Feedback


12. LLM-Evolved Pattern Generators for Optimal Classical Planning


13. Bridging the Sim-to-Real Gap in Semiconductor Visual Program Synthesis via Input Binarization


14. AgentPLM: Agentic Protein Language Models with Reasoning-Augmented Decoding for Protein Sequence Design


15. A Mathematical Conflict Framework for Contextual Data Modulation


16. Spatial Representation Learning Beyond Pixels: Unifying Raster Data and Vector Semantics for Human-Centric Geospatial Foundation Models


17. Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses


18. COMAP: Co-Evolving World Models and Agent Policies for LLM Agents


19. MOC: Multi-Order Communication in LLM-based Multi-Agent Systems


20. SIRI: Self-Internalizing Reinforcement Learning with Intrinsic Skills for LLM Agent Training


21. Coordination Graphs for Constrained Multi-Agent Reinforcement Learning


22. Forget Attention: Importance-Aware Attention Is All You Need


23. Repair Before Veto: Repair-Augmented Constraint Learning for Contextual Decisions


24. POIROT: Interrogating Agents for Failure Detection in Multi-Agent Systems


25. CEON: Circular Economy Ontology Network


26. From Capability Models to Automated Planning: An AAS-Native Approach for Automatic PDDL Generation


27. An Abstract Worlds Semantic Framework for Belief Change Operators


28. S3TS: Stochastic Scenario-Structured Tree Search for Advanced Planning Under Uncertainty


29. Learning When Not to Act: Mitigating Tool Abuse in Agentic Reinforcement Learning


30. BADGER: Bridging Agentic and Deterministic Evaluation for Generative Enterprise Reasoning


31. Where Do Deep-Research Agents Go Wrong? Span-Level Error Localization in Agent Trajectories


32. eMoT: evolving Memory-of-Thought via Symbolic Anchoring and Memory Corrosion


33. Explainable Data-driven Deep Reinforcement Learning Methods for Optimal Energy Management in Buildings


34. Topological texture analysis of microscopy images of dynamic casein gelation and its relation to rheological properties


35. RL-ACRGNet: Reinforcement Learning-Based Chest Radiology Report Generation Network


36. Extreme Low-Bit Inference in Reasoning Models: Failure Modes and Targeted Recovery


37. SafeMCP: Proactive Power Regulation for LLM Agent Defense via Environment-Grounded Look-Ahead Reasoning


38. An NLP-Driven Framework for Curriculum-Labor Market Alignment: Schema-Constrained LLM Extraction, ESCO-Anchored Semantic Matching, and Multi-Dimensional Gap Quantification


39. Algorithmic algorithm development with LLMs: A Case Study on LLM-Usage for Contraction Order Optimization in Tensor Networks


40. AutoMedBench: Towards Medical AutoResearch with Agentic AI Models


41. VET: A Framework for Analyzing AI Discourse


42. SMH-Bench: Benchmarking LLM Agents for Environment-Grounded Reasoning and Action in Smart Homes


43. Bayesian Spectral Emotion Transition Discovery from Multi-Annotator Disagreement


44. Community-Aware Assessment of Social Textual Engagement and Resonance: A Human-Centric Perspective on User-Generated Content Evaluation


45. Physically-Constrained Mamba-SDE for Remaining Useful Life Prediction under Irregular Observations


46. Absorbing Complexity: An Interaction-Native Knowledge Harness for Financial LLM Agents


47. EVA-Net: Subject-Independent EEG Motor Decoding with Video-Derived Motor Priors


48. WorldCoder-Bench: Benchmarking Physically Grounded 3D World Synthesis


49. Does Compression Preserve Uncertainty? A Unified Benchmark for Quantized and Sparse LLMs via Conformal Prediction



51. CAPF: Guiding Search-Agent Rollouts with Credit-Attenuated Privileged Feedback


52. Token Predictors Are Not Planners: Building Physically Grounded Causal Reasoners


53. OctoT2I: A Self-Evolving Agentic Text-to-Image Router


54. Consistency evaluation of benchmarks used for causal discovery


55. Stochastic convergence of parallel asynchronous adaptive first-order methods


56. Structure-Guided Adaptive Propagation for Protein-Protein Interaction Site Prediction


57. EvoBrain: Continual Learning of EEG Foundation Models Across Heterogeneous BCI Tasks


58. TriAlign: Towards Universal Truth Consistency in Personalized LLM Alignment


59. TrafficRAG: A Multimodal RAG Framework for Traffic Accident Liability Determination


60. Evidence-Gated LLM Priors for Multi-Objective Bayesian Optimization


61. Characterization of Multi-Model Agentic AI Systems on General Tasks via Trace-Driven Simulation


62. MobEvolve: An Agentic Self-Evolving Heuristic System for Interpretable Human Mobility Generation


63. ReSkill: Reconciling Skill Creation with Policy Optimization in Agentic RL


64. Revisiting Ripple Effects in Knowledge Editing through Pressure-Aware Joint Neighborhood Optimization


65. TRON: Targeted Rule-Verifiable Online Environments for Visual Reasoning RL


66. S-SPPO: Semantic-Calibrated Self-Play Preference Optimization


67. RoleCDE:Benchmarking and Mitigating Role-Alignment Trade-offs in Role-Playing Agents


68. Joint Agent Memory and Exploration Learning via Novelty Signals


69. TERRA: Task-Embedded Reasoning and Representation Architecture for Cross-Domain Applications


70. A Minimalist Brain-Computer Musical Interface for Real-Time Emotion-Driven Sonification: System Design and Preliminary Evaluation


71. An Enigma of Artificial Reason: Investigating the Production-Evaluation Gap in Large Reasoning Models


72. Transferring Information Across Interventions in Causal Bayesian Optimization


73. Self-Revising Discovery Systems for Science: A Categorical Framework for Agentic Artificial Intelligence


74. Dive into Ambiguity: A*-Inspired Multi-Agents Commonsense Obfuscation Attack on LLM Prompts


75. Don’t Ask the LLM to Track Freshness: A Deterministic Recipe for Memory Conflict Resolution


76. GovAI-Pipe: A Layered AI Governance Pipeline for Citizen-Facing AI in Turkey’s e-Government Gateway


77. Self-Healing Agentic Orchestrators for Reliable Tool-Augmented Large Language Model Systems


78. GuidaPA: Privacy-Preserving Chatbot for Public Administration via Federated Learning


79. Early Diagnosis of Wasted Computation in Multi-Agent LLM Systems via Failure-Aware Observability


80. FlowTime: Towards Continuous Generative Watch Time Prediction via Flow-based Personalized Priors


81. Recognize Your Orchestrator: An Entropy Dynamics Perspective for LLM Multi-Agent Systems


82. Science Earth: Towards A Planet-Scale Operating System for AI-Native Scientific Discovery


83. SkillSmith: Co-Evolving Skills and Tools for Self-Improving Agent Systems


84. ANDES: Agent Native Data Evolving Synthesis Tool for Autonomous Instruction Alignment


85. Emergent Ordinal Geometry in Transformers Trained on Local Comparisons


86. SIRIUS-SQL: Anchoring Multi-Candidate Text-to-SQL in Execution Feedback


87. Brain-Atlas-Guided Generative Counterfactual Attention for Explainable Cognitive Decline Diagnosis Using Multimodal Connectomes


88. HomeFlow: A Data Flywheel for Smart Home Agent Training with Verifiable Simulation


89. Application of Algorithms in Energy-Efficient Design Platforms for Green Building


90. Advanced Mathematics Learning Behavior Prediction and Academic Early Warning Model Based on Multimodal Data Analysis


91. The Shape of Wisdom: Decision Trajectories in Language Models


92. Can LLM Agents Sustain Long-Horizon Organizational Dynamics?


93. The Case for Model Science: Verify, Explore, Steer, Refine


94. “Skill issues’’: data-centric optimization of lakehouse agents


95. Deft Scheduling of Dynamic Cloud Workflows with Varying Deadlines via Mixture-of-Experts


96. Expected Value Alignment for Generative Reward Modeling in Formal Mathematics Verification


97. Reasoning4Sciences: Bridging Reasoning Language Models to All Scientific Branches


98. SkillRevise: Improving LLM-Authored Agent Skills via Trace-Conditioned Skill Revision


99. Diagnosing LLM Arbitration Behavior over Pre-evidence Epistemic States in RAG-based Fact-Checking


100. CAREAgent: Clinical Agent with Structured Reasoning and Tool-Integrated for Order Generation


101. Before the Model Learns the Bug:Fuzzing RLVR Verifiers


102. MindClaw: Closed-Loop Embodied Mental-State Reasoning for Precision Intervention


103. DAG-MoE: From Simple Mixture to Structural Aggregation in Mixture-of-Experts


104. AnyEdit++: Adaptive Long-Form Knowledge Editing via Bayesian Surprise


105. TravelEval: A Comprehensive Benchmarking Framework for Evaluating LLM-Powered Travel Planning Agents


106. TriLens: Per-Layer Logit-Lens Entropy for White-Box Hallucination Detection


107. Tackling the Root of Misinformation by Teaching Laypeople about Logical Fallacies via Socratic Questioning and Critical Argumentation


108. Can AI Review Improve Paper Drafting? An Empirical Study on 20 Computer Architecture Submissions


109. Property Prediction of Stacked Bilayer Materials: A Multimodal Learning Approach


110. Subliminal Learning Is Steering Vector Distillation


111. Large Language Models in Transportation Systems Management and Operations: From Text Reasoning to Multi-modal Decision Support


112. Prospect-Theory Behavior from Bellman Optimality in MDPs with Catastrophic States


113. Towards Understanding Modality Interaction in Multimodal Language Models via Partial Information Decomposition


114. Relational Intervention During Functional Collapse in Large Language Models: A Lexical-Statistical Ablation and a Structure x Register Factorial


115. Adversarial Feeds Steer LLM Agent Decisions Against Their Defaults


116. Ryze: Evidence-Enriched Data Synthesis from Biomedical Papers


117. Certificate-Guided Evaluation of Reinforcement Learning Generalization


118. Decoupled Behavioral Cloning for Scalable Inductive Generalization in RL from Specifications


119. Subliminal Learning is a LoRA Artifact


120. Mitigating Hallucinations in Large Language Models Via Decoder Layer Skipping


121. NBQ: Next-Best-Question for Dynamic Profiling


122. Interaction-Centered Intelligence: Toward Interaction as the Primary Unit of Analysis in Co-Creative AI and Human-AI Systems



124. CoMIC: Collaborative Memory and Insights Circulation for Long-Horizon LLM Agents in Cloud-Edge Systems


125. SHARP: Sleep-based Hierarchical Accelerated Replay for Long Range Non-Stationary Temporal Pattern Recognition


126. AI Sovereignty as National Learning Capacity: A Human-Centered Learning Mechanics Viewpoint on France, the United States, and China


127. Latent Reward Steering: An Adaptive Inference-Time Framework that Implicitly Promotes Cognitive Behaviors in Reasoning LLMs


128. LLM-Driven Co-Evolutionary Automated Heuristic Design for Bi-Component Coupled Combinatorial Optimization


129. MOSAIC: Modular Orchestration for Structured Agentic Intelligence and Composition


130. Regularized Offline Policy Optimization with Posterior Hybrid Bayesian Belief


131. Medication-Aware Financial Exploitation Detection for Alzheimer’s Patients Using Edge-Aware Interaction Risk Modeling


132. AXIOM: A Trust-First Neuro-Symbolic Execution Architecture for Verifiable Mathematical Reasoning


133. ForeSci: Evaluating LLM Agents for Forward-Looking AI Research Judgment


134. Hidden Thoughts Are Not Secret: Reasoning Trace Exposure in LLMs


135. Efficient Test-time Inference for Generative Planning Models


136. TRACE: Trajectory Risk-Aware Compression for Long-Horizon Agent Safety


137. PropLLM: Propagation-Aware Scene Reconstruction for Network Fault Diagnosis


138. Probe Before You Edit: Probing-Guided Molecular Optimization for LLM Agents in Structure-Based Drug Design


139. KACE: Knowledge-Adaptive Context Engineering for Mathematical Reasoning


140. Acting with AI: An Interaction-Based Framework for Agentic Tort Liability


141. Threshold-Based Exclusive Batching for LLM Inference


142. EnergyMamba: An Uncertainty-Aware Graph-Enhanced Selective State Space Model for Energy Consumption Prediction


143. TAPS: Target-Aware Prefix Tree Selection for Diffusion-Drafted Speculative Decoding


144. Doing What They Say, Not What They Reason: Locating the Faithfulness Gap in LLM Agents


145. SDR: Set-Distance Rewards for Radiology Report Generation


146. Weak Critics Make Strong Learners: On-Policy Critique Distillation for Scalable Oversight


147. VESTA: Visual Exploration with Statistical Tool Agents


148. The Deterministic Horizon: When Extended Reasoning Fails and Tool Delegation Becomes Necessary


149. From “Weak” Signals to Strong Models: Preference Delta Aggregation with LoRA Merging


150. From Noise to Control: Parameterized Diffusion Policies


151. Coupling Language Models with Physics-based Simulation for Synthesis of Inorganic Materials


152. Model-Native Computing Architecture: Envisioning Future System Architecture Through the Lens of Computer Architecture


153. Evaluating Bivariate Causal Statements Based on Mutual Compatibility



155. Robust Shielding for Safe Reinforcement Learning


156. Closed-Loop Neural Activation Control in Vision-Language-Action Models


157. Capability Self-Assessment: Teaching LLMs to Know Their Limits


158. Geodesic Flow Matching for Denoising High-Dimensional Structured Representations


159. MindZero: Learning Online Mental Reasoning With Zero Annotations


160. TIGER: Traceable Inference with Graph-Based Evidence Routing for Mitigating Hallucinations in Multimodal Generation


161. CAST: Non-Privileged Clipped Asymmetric Self-Teaching with Advantage Flipping for GRPO


162. A Multi-AI-agent Framework Enabling End-to-end Finite Element Analysis for Solid Mechanics Problems


163. Evaluating Interactive Reasoning in Large Language Models: A Hierarchical Benchmark with Executable Games


164. On the evolution of the concept of probability as a mirror of the evolution of reason


165. Product-Aware Deep Autoencoders for Robust Process Monitoring in Multi-Product Cyber-Physical Systems


166. Grokers: Bottom-Up Inductive Comprehension and Write-Time Intelligence over Typed Knowledge Graphs


167. Universal Quantum Transformer


168. MindGames Arena Generalization Track: In2AI Solution with Delayed Per-Step Reward Attribution


169. Optimal Transport-based Permutation-Invariant Bayesian Optimization of Offshore Wind Farm Layouts


170. Agents on a Tree: Pathwise Coordination for Multi-Objective Molecular Optimization


171. Deliberative Curation: A Protocol for Multi-Agent Knowledge Bases


172. Emergent Collaborative Deliberation in Multi-Model AI Systems: A BFT-Derived Protocol for Epistemic Synthesis


173. Position Paper: Post-Solve Robustness in Decision Engines: Feasible Regions and Smoothness Under Perturbations


174. Mitigating Perceptual Judgment Bias in Multimodal LLM-as-a-Judge via Perceptual Perturbation and Reward Modeling


175. AdaCodec: A Predictive Visual Code for Video MLLMs


176. Permissive Safety Through Trusted Inference: Verifiable Belief-Space Neural Safety Filters for Assured Interactive Robotics


177. From Layers to Submodules: Rethinking Granularity in Replacement-Based LLM Compression


178. Modeling Depth Ambiguity: A Mixture-Density Representation for Flying-Point-Free Depth Estimation


179. SimSD: Simple Speculative Decoding in Diffusion Language Models


180. Why Not Hyperparameter-Friendly Optimisation? A Monotonic Adaptive Norm Rescaling Approach For Long-Tailed Recognition


181. Moment-Video: Diagnosing Temporal Fidelity of Video MLLMs on Momentary Visual Events


182. Monitoring Agentic Systems Before They’re Reliable


183. Ghost Tool Calls: Issue-Time Privacy for Speculative Agent Tools


184. Learning When to Translate for Multilingual Reasoning


185. MASER: Modality-Adaptive Specialist Routing for Embodied 3D Spatial Intelligence


186. Initialization is Half the Battle: Generating Diverse Images from a Guidance Potential Posterior


187. PaSBench-Video: A Streaming Video Benchmark for Proactive Safety Warning


188. ODTQA-FoRe: An Open-Domain Tabular Question Answering Dataset for Future Data Forecasting and Reasoning


189. Not All Errors Are Equal: A Systematic Study of Error Propagation in Large Language Model Inference


190. GC-MoE: Genomics-Guided Cell-Type-Specific Mixture of Experts for Histology-Based Single-Cell Spatial Transcriptomics



192. AutoForest: Automatically Generating Forest Plots from Biomedical Studies with End-to-End Evidence Extraction and Synthesis


193. Policy and World Modeling Co-Training for Language Agents


194. SPADE-Bench: Evaluating Spontaneous Strategic Deception in Agents via Plan-Action Divergence


195. When Do Attention Circuits Form? Developmental Trajectories of Capability and Attention-Sink Emergence Across Three 1B-ClassArchitectures


196. FOAM: Frequency and Operator Error-Based Adaptive Damping Method for Reducing Staleness-Oriented Error for Shampoo


197. Do Multimodal Agents Really Benefit from Tool Use? A Systematic Study of Capability Gains


198. Repurposing Adversarial Perturbations for Continual Learning: From Defense to Active Alignment


199. SeClaw: Spec-Driven Security Task Synthesis for Evaluating Autonomous Agents


200. Quantitative Movement Testing: Measuring Patient Movements from a Single Smartphone Video


201. CityTrajBench: A Unified Benchmark for City-Scale Vehicle Trajectory Generation


202. Cross-modal linkage risk in clinical vision-language models


203. Who Annotates in NLP? A Large-scale Assessment of Human Annotation Reporting between 2018 and 2025


204. FW-NKF: Frequency-Weighted Neural Kalman Filters


205. Towards Resolving Optimization Conflicts Between Image- and Text-Based Person Re-Identification


206. AgentRedBench: Dynamic Redteaming and Integration-Aware Defense for LLM Agents over SaaS Integrations


207. Faster Synchronous On-Policy RL via Straggler-Aware Group Sizing


208. Consistency Training while Mitigating Obfuscation via Rate Matching


209. On the Generalization in Topology Optimization via Sensitivity-Conditioned Bernoulli Flow Matching


210. Order within Chaos: Capturing Intrinsic Energy Anomalies for AI-Manipulated Image Forgery Localization


211. Multimodal Approaches for Visually-Rich Document Type Classification: A Comparative Analysis


212. Predicting the risk of colorectal anastomotic leak based on preoperative mapping of the blood supply of the bowel


213. Multilingual Idioms in Sentences and Conversations Across High-, Medium-, and Low-Resource Languages


214. VLBM: Variational Latent Basis Modeling for OOD Robust Multivariate Time Series Forecasting


215. Rethinking Evaluation Paradigms in IBP-based Certified Training


216. Variational Learning for Insertion-based Generation


217. Understanding-Enhanced Model Collaboration for Long-Tailed Egocentric Mistake Detection


218. How Hard Can It Be? Hardness-Aware Multi-Objective Unlearning


219. A Primer in Post-Training Reasoning Data: What We Know About How It Works


220. Jailbreaking Multimodal Large Language Models using Multi-Clip Video


221. Network Distributed Multi-Agent Reinforcement Learning for Consensus Control of Quadcopters


222. The Role of Ambiguity in Error Prediction via Uncertainty Quantification


223. LALE: Lightweight-Transformer Architecture for Land-Cover Estimation


224. Agentic-J: An AI Agent for Biological Microscopy Image Analysis


225. Fast and Lightweight Novel View Synthesis with Differentiable Multiplane Image


226. Attention mechanisms and transfer learning for robust peach leaf damage classification under domain shift


227. OpenWebRL: Demystifying Online Multi-turn Reinforcement Learning for Visual Web Agents


228. Ranking vs. Assignment: The Metric Mismatch in Multi-View Object Association


229. PlanarBench: Evaluating LLM Spatial Reasoning via Planar Graph Drawing


230. Towards 3D-Aware Video Diffusion Models: Render-Free Human Motion Control with Mesh Tokenization


231. Why Do Time Series Models Need Long Context Windows?


232. MMG2Skill: Can Agents Distill In-the-Wild Guides into Self-Evolving Skills?


233. A Structured Benchmark for Text-Guided Anomaly Detection: When Language Stops Conditioning the Decision


234. Rank-Constrained Deep Matrix Completion for Group Recommendation


235. Parameter-Efficient Fine-Tuning of Large Pretrained Models for Instance Segmentation Tasks


236. Echo: A Joint-Embedding Predictive Architecture for Speaker Diarization and Speech Recognition in a Shared Latent Space


237. KliniskVestBERT: BERT Model Specialised to Norwegian Clinical Texts


238. The Image Reconstruction Game: Drawing Common Ground Through Iterative Multimodal Dialogue


239. RA-LWLM: Retrieval-Augmented In-Context Localization with Wireless Foundation Models


240. Train, Test, Re-evaluate: Schedule-Sensitive Evaluation of Generative Data for Hand Detection


241. Collaborative Space Object Detection with Multi-Satellite Viewpoints in LEO Constellations


242. RadioMaster: Multi-Agent System for Autonomous Radio Signal Generation


243. Boosting Multimodal Federated Learning via Chained Modality Optimization


244. Unveiling the Limits of Large Language Models in Inferring Pragmatic Meaning from Non-Verbal Responses


245. Suppressing Forgery-Specific Shortcuts for Generalizable Deepfake Detection


246. LayerRoute: Input-Conditioned Adaptive Layer Skipping via LoRA Fine-Tuning for Agentic Language Models


247. Physics-Guided Attention in a Lightweight TCN for Efficient WiFi CSI-Based Human Activity Recognition


248. Learning Implicit Bias in Generative Spaces for Accelerating Protein Dynamics Emulation


249. Dynamic Trust-Aware Sparse Communication Topology for LLM-Based Multi-Agent Consensus


250. “I’ve Seen How This Goes”: Characterizing Diversity via Progressive Conditional Surprise


251. ProbeScale: Probing Analysis to Optimize Neural Scaling Laws for Efficient Small Language Model Inference


252. MOSS-Audio Technical Report


253. Multilinguality of Large Language Models From a Structural Perspective


254. STaR-KV: Spatio-Temporal Adaptive Re-weighting for KV Cache Compression in GUI Vision-Language Models


255. Breaking the Information Silo: Semantic Personas for Cross-Domain Recommendation


256. FLARE: Diffusion for Hybrid Language Model


257. Adaptive Auto-Harness: Sustained Self-Improvement for Agentic System Deployment on Open-Ended Task Streams


258. Construction of Historical Knowledge Graphs Based on BERT and Graph Neural Networks


259. SECUREVENT: Hybrid AI/ML Security Monitoring for Distributed Event-Based Systems


260. THRD: A Training-Free Multi-Turn Defense Framework for Jailbreak Attacks on Large Language Models


261. Argument Collapse: LLMs Flatten Long-Form Public Debate


262. Shortcut to Nowhere: Demystifying Deep Spurious Regression


263. Post-Deterministic Distributed Systems: A New Foundation for Trustworthy Autonomous Infrastructure


264. Fair Finetuning Mitigates Distribution Inference Attacks


265. Two-Fidelity Best-Action Identification for Stochastic Minimax Tree


266. JenBridge: Adaptive Long-Form Video Soundtracking across Scene Transitions


267. Understanding Identity Continuity in Thermal Video through Scene-Level Consistency


268. RPCASSM: Robust PCA State Space Model For Infrared Small Target Detection


269. HAIM: Human-AI Music Datasets for AI Music Production Tracking Benchmark


270. Off-the-Shelf LLMs as Process Scorers: Training-Free Alternative to PRMs for Mathematical Reasoning


271. Time-Aware Diffusion based on Preference Disentanglement for Generative Recommendation


272. DOT-MoE: Differentiable Optimal Transport for MoEfication


273. MINTS: Minimalist Thompson Sampling


274. Easier to Mislead Than to Correct: Harmful and Beneficial Revision in LLM Conformity


275. AlphaToken: Decoupling Adaptation and Stability for Path-Aware Response Token Valuation in LLM Post-Training


276. E4GEN: Event-level Explainable Extreme-Enhanced Time-series Generation


277. A Framework for Graph-Conditioned Hierarchical Shapley Attribution in Patent Valuation


278. Demystifying Multimodal Biomolecular Co-design With Intrinsic Geodesic Coupling


279. EvoPool: Evolutionary Programmatic Annotation for Label-Efficient Specialized Supervision


280. TechGraphRAG: An Agentic Graph-Augmented RAG Framework for Technical Literature Reasoning


281. FedMTFI: Feature Importance Based Optimized Multi Teacher Knowledge Distillation in Heterogeneous Federated Learning Environment


282. Estimating Mutual Information between Time Series and Temporal Event Sequences Across Diverse Analysis Tasks


283. Identifying High-Confidence Social Biases in LLMs for Trustworthy Conversational Tutoring Agents


284. Defenses & Enablers For Skill Injection Attacks on Terminal Based Agents


285. GJDNet: Robust Graph Neural Networks via Joint Disentangled Learning Against Adversarial Attacks


286. Self-Conditioned Positional HNSW for Overlap-Aware Retrieval in Chunked-Document RAG Systems: Method and Industrial Evidence-Quality Audit


287. TN-SHAP-G: Graph-Structured Tensor Network Surrogates for Shapley Values and Interactions


288. Compliance-Scored Best-of-N Guardrail Orchestration for Multimodal Document Generation in Payments Dispute Defense


289. ProbMoE: Differentiable Probabilistic Routing for Mixture-of-Experts


290. Agent Operating Systems (AOS): Integrating Agentic Control Planes into, and Beyond, Traditional Operating Systems


291. On the Limits of Token Reduction for Efficient Unified Vision Language Training


292. Move the Query, Not the Cache: Characterizing Cross-Instance Latent Attention Redistribution Across GPU Fabrics


293. TimeSage-MT: A Multi-Turn Benchmark for Evaluating Agentic Time Series Reasoning


294. ClawHub Security Signals: When VirusTotal, Static Analysis, and SkillSpector Disagree


295. LLM Consortium for Software Design Refinement: A Controlled Experiment on Multi-Agent Collaboration Topologies


296. MURMUR: An Efficient Inference System for Long-Form ASR


297. Crazyflow: An Accurate, GPU-Accelerated, Differentiable Drone Simulator in JAX


298. Hierarchical Online Prompt Mutation with Dual-Loop Feedback for Guardrailed Evidence Document Generation: A Production-Evaluation Case Study


299. Emergent Transfer of a Physics Foundation Model from Simulation to Laboratory Turbulence


300. Computation-Aware Kalman Filtering with Model Selection for Neural Dynamics


301. UR-JEPA: Uniform Rectifiability as a Regularizer for Joint-Embedding Predictive Architectures


302. On the Evaluation of Spiking Neural Network Configurations for Network Intrusion Detection


303. CEAR: Certified Ensemble Adversarial Robustness in DNNs


304. Neural Network Compression by Approximate Differential Equivalence


305. Consistent and Distinctive: LLM Benchmark Efficiency via Maximum Independent Set Prompt Selection on Similarity Graphs


306. Dr. DocBench: A Comprehensive Benchmark for Expert-Level and Difficult Document Parsing


307. Bridging Requirements and Architecture: Multi-Agent Orchestration with External Knowledge and Hierarchical Memory


308. Efficient Exploration for Iterative Nash Preference Optimization


309. Beyond Access: Guided LLM Scaffolding for Independent Learning in Undergraduate Statistics


310. BRo-JEPA: Learning Modular Arithmetic in Latent Space


311. Needles at Scale: LLM-Assisted Target Selection for Windows Vulnerability Research


312. FreqLite: A Lightweight Frequency-Decomposed Linear Model with Adaptive Reversible Normalization for Robust Long-Term Time-Series Forecasting


313. Digital Twin-Assisted Adaptive Multi-Agent DRL for Intelligent Spectrum and Resource Management in Open-RAN UAV-Enabled 6G Networks


314. DiffuSent: Towards a Unified Diffusion Framework for Aspect-Based Sentiment Analysis


315. TukaBench: A Culturally Grounded Jailbreak Benchmark for African Languages


316. PSG-Nav: Probabilistic Scene Graph Navigation via Multiverse Decision Making


317. A Communication-Centric 6G-LLM Architecture for Scalable Tactical Autonomous Defense Vehicle Networks


318. SkillAdaptor: Self-Adapting Skills for LLM Agents from Trajectories


319. ChronosAD: Leveraging Time Series Foundation Models for Accurate Anomaly Detection


320. ResNet-34 with Lightweight Decoder for Accurate and Efficient Segmentation of Fetal Brain MRI


321. What Makes a Strong Model? A Unified Spectral Analysis of Knowledge Transfer over High-dimensional Linear Regression


322. Quantum Algorithm for Distributed Reduction of Entanglements (QADR): A Trainable and Simulation-Efficient QML Framework


323. Beyond Visual Memory: Mechanistic Diagnostics of Latent Visual Reasoning


324. BenchEvolver: Frontier Task Synthesis via Solution-Centric Evolution


325. Knowledge-Intensive Video Generation


326. RLVR without Ineffective Samples: Group Prioritized Off-Policy Optimization for LLM Reasoning


327. DeepIPCv3: Event-Aware Multi-Modal Sensor Fusion for Sudden Pedestrian Crossing Avoidance


328. PALTO: Physics-Informed Active Learning for Tri-Gate FinFET Design Optimization for Vertical Power Delivery


329. IndoBias: A Dual Track Culturally Grounded Benchmark for LLMs Bias Evaluation in Indonesian Languages


330. Understanding LLM Behavior in Multi-Target Cross-Lingual Summarization


331. Connecting the Dots: Benchmarking Reflective Memory in Long-Horizon Dialogue


332. Hybrid Imbalanced Regression Through Unified Data-Level and Algorithm-Level Balancing


333. Fine-Tuning Diffusion Models for Molecular Generation via Reinforcement Learning and Fast Sampling


334. Distilling Neuro-Symbolic Programs into 3D Multi-modal LLMs


335. TECCI: Tricky Edits of Collected and Curated Images


336. DiscourseFlip: An Oblique Discourse-Level Opinion Manipulation Attack against Black-box Retrieval-Augmented Generation


337. Implicit Geographic Inference in LLM Medical Triage: Language-Driven Disparities in Emergency Recommendations


338. Low-Resource Safety Failures Are Action Failures, Not Representation Failures


339. pcbGPT: Automatic PCB Schematic Synthesis from Natural Language Requirements


340. Topological Ignorability for Structural Causal Effects Beyond Means


341. CA-BED: Conversation-Aware Bayesian Experimental Design


342. Physics-Informed Deep Learning for Entropy Prediction in Heterogeneous Systems: Thermodynamic and Information-Theoretic Case Studies


343. AI From the Margins (AIM): Rethinking Participatory AI Design Through the Lived Experience of Minoritized Communities


344. When Data Is Scarce: Scaling Sparse Language Models with Repeated Training


345. ASE-26: a curriculum for agentic software engineering as a discipline


346. AMP: A Vendor-Neutral Wire Format for Agent Memory Operations


347. STARFISH: faST Accuracy Recovery in pruned networks From Internal State Healing


348. HASTE: Hardware-Aware Dynamic Sparse Training for Large Output Spaces


349. Soft-NBCE: Entropy-Weighted Chunk Fusion for Long-Context


350. MiCU: End-to-End Smart Home Command Understanding with Large Language Model


351. Implicit Drifting Policy: One-Step Action Generation via Conditional Expert Geometry


352. Beyond Task Success: Behavioral and Representational Diagnostics for WAM and VLA


353. A Fiber Criterion for Representation Identifiability in Supervised Learning


354. Strong Stochastic Flow Maps


355. MViewRouter: Internalizing Geometric Equivariance via Multi-view Alternating Attention for Combinatorial Routing


356. ThinkSwitch: Context Distillation with LoRA and Weight Interpolation for Specific-Purpose Reasoning Tasks


357. Test-Time Training for Zero-Resource Dense Retrieval Reranking


358. Leyline: KV Cache Directives for Agentic Inference


359. MENTIS: What Belief Changes Under Alignment? Measuring Multi-Scale Latent Torsion in Language Models


360. 3DCodeBench: Benchmarking Agentic Procedural 3D Modeling Via Code


361. Plausibility Is Not Prediction: Contrastive Evidence for LLM-Based Cellular Perturbation Reasoning


362. OPD+: Rethinking the Advantage Design for On-Policy Distillation


363. Temporally-Aligned Evaluation for Audio-Driven Talking Head Generation


364. DSL-LLaDA: Scaling Continuous Denoising to 8B Masked Diffusion LMs


365. Data Collection for Training Quality-Control AI in Carpet Manufacturing


366. ProductWebGen: Benchmarking Multimodal Product Webpage Generation


367. Hybrid Verified Decoding: Learning to Allocate Verification in Speculative Decoding


368. PolySpeech-100: A Large-Scale Benchmark for Speech Understanding Across 100+ Languages and Dialects



370. Cross-Axis Feature Fusion with Joint-Wise Motion Difference Prediction for Text-Based 3D Human Motion Editing


371. FVSpec: Real-World Property-Based Tests as Lean Challenges


372. Beyond Task-Agnostic: Task-Aware Grouping for Communication-Efficient Multi-Task MoE Inference


373. An Open-Source Benchmark and Baseline for Multi-temporal Referring Segmentation


374. SS-ZKR: Spatial-Semantic Zero-Knowledge Routing for Privacy-Preserving Multi-Agent Collaboration


375. Explainable deep reinforcement learning reveals energy-efficient control strategies for turbulent drag reduction


376. Silent Failures in Federated Personalization of Foundation Models


377. Lodestar: An Online-Learning LLM Inference Router


378. CV-Arena: An Open Benchmark for Instructional Computer Vision Problem Solving with Human-AI Collaborative Preferences


379. Detection vs. Execution: Single-Bucket Probes Miss Half the Mamba-2 State Sink


380. Benchmarking Security Risk Detection and Verification in Open Agentic Skill Ecosystems


381. Accuracy, Stability, and Repeated-Run Reliability of Large Language Models on Deterministic Programming Tasks


382. MLLM-Microscope: Unlocking Hidden Structure Within Multimodal Large Language Models


383. Memory-Efficient LLM Training with Dynamic Sparsity: From Stability to Practical Scaling


384. Dive into Waves: Morlet Spectral Transformer for Cross-Subject Emotion Decoding from EEG


385. Task diversity produces systematic transfer but inhibits continual reinforcement learning


386. Benchmarks for Vision-Language Models in Urban Perception Should Be Reliability-Aware and Negotiated


387. GenPT: Beyond Self-Report for Reliable LLM Psychometrics via Generative Projective Testing


388. From Cues to Horizons: Dynamic Risk Horizon Profiling for Trajectory Prediction


389. RefDiffNet: Learning to Expose Subtle PCB Defects Before Detection


390. MoEIoU: Rethinking Bounding-Box Regression as a Mixture of Experts


391. Hybrid Probabilistic Forecasting of Under-Five Malaria Admissions in Ghana: A Gaussian Process Regression with Holt-Winters Smoothing


392. Beyond Independent Manipulation: Individual Fairness-aware Strategic Classification with Peer Imitation


393. SkillPager: Query-Adaptive Intra-Skill Navigation via Semantic Node Retrieval


394. Certificates without Electrons? Theory and Evidence on Impacts from AI-Driven Power Demand


395. Dynamic Coordination Strategy Selection for Enterprise Multi-Agent Systems


396. DASH: Dual-Branch Score Distillation for Guidance-Calibrated Compact Diffusion Models


397. Extending Causal Metamodeling to a non-Markovian Queue


398. Bayesian Inference of Nonlinear Malaria Dynamics in Ghana via an Ensemble Markov Chain Monte Carlo Sampler


399. Behavior-Invariant Task Representation Learning with Transformer-based World Models for Offline Meta-Reinforcement Learning


400. GIRL-DETR: Gradient-Isolated Reinforcement Learning for Video Moment Retrieval


401. Logit Distillation on Manifolds: Mapping by Learning


402. Causal Density Functions


403. SkyShield: Occupancy as a Safety Interface for Low-Altitude UAV Autonomy


404. Quantum Tunneling-Aware Machine Learning: Physics-Derived Noise Models for Robust Deployment


405. SORA: Free Second-Order Attacks in Fast Adversarial Training


406. WaveFilter: Enhancing the Long-Context Capability of Diffusion LLMs via Wavelet-Guided KV Cache Filtering


407. EPIC: Efficient and Parallel Inference under CFG Constraints for Diffusion Language Models


408. Multi-Agent Conformal Prediction with Personalized Statistical Validity


409. Information-Theoretic Lower Bounds for Bit-Constrained Stochastic Optimization via a Reduction to Compressed Gaussian Mean Estimation


410. Shape Your Body: Value Gradients for Multi-Embodiment Robot Design


411. COPF: An Online Framework for Deployment-Stable Counterfactual Fairness in Evolving Graphs


412. The Paradox of Outcome Optimization: A Causal Information-Theoretic Bound on Reasoning Shortcuts in LLMs


413. Beyond the Mouth: Upper-Face Affective Cues in Audiovisual Sentence Recognition under Acoustic Uncertainty


414. Collaborative Few-Step Distillation and Low-Bit Quantization for Wan2.2 Dual-Expert Video Diffusion Models


415. Demystifying the Optimal Fair Classifier in Multi-Class Classification


416. Scaling Behavior of Single LLM-Driven Multi-Agent Systems


417. MESA: Improving MoE Safety Alignment via Decentralized Expertise


418. LinguIUTics at PsyDefDetect: Iterative Imbalance-Aware Fine-tuning of Qwen3-8B for Psychological Defense Mechanism Classification


419. LP5X-PIM Sim: A High-Fidelity HW/SW Integrated Simulator for LPDDR5X-PIM


420. Authenticity Debt and the Synthetic Content Threat Landscape: A Layered Framework for Trust, Provenance, and IP Governance in the Generative AI Era


421. MemPro: Agentic Memory Systems as Evolvable Programs


422. Pause and Think: A Dataset and Benchmark for Video-Grounded Assistive Action Suggestion


423. Linguistics-Aware Non-Distortionary LLM Watermarking


424. MemGraphRAG: Memory-based Multi-Agent System for Graph Retrieval-Augmented Generation


425. CARE-RL: Capability-Aware Reinforcement Learning for Mitigating Cross-Domain Conflicts


426. SPADER: Step-wise Peer Advantage with Diversity-Aware Exploration Rewards for Multi-Answer Question Answering


427. Critic-R: Improving Agentic Search using Instruction-tuned Retrievers with Natural Language Introspective Feedback


428. Improving Visual Representation Alignment Generation with GRPO


429. On the Difficulty of Learning a Meta-network for Training Data Selection


430. Revisiting Parameter-Based Knowledge Editing in Large Language Models: Theoretical Limits and Empirical Evidence


431. A Practical Upper Bound on Selection Bias Effects in Medical Prediction Models


432. Interpretable Policy Distillation for Power Grid Topology Control


433. Richer Representations for Neural Algorithmic Reasoning via Auxiliary Reconstruction


434. CAFOSat: A Strongly Annotated Dataset for Infrastructure-Aware CAFO Mapping Using High-Resolution Imagery


435. PaCo-VLA: Passivity-Shielded Compliance Prior for Contact-Rich Vision-Language-Action Manipulation


436. Skill or Skip? Learning Selective Skill Invocation in Agentic Tasks via Dual-Granularity Preference Learning


437. V-LynX: Token Interface Alignment for Video+X LLMs


438. TabChange: Precise Attribute Changes in Tabular Data


439. Pre-Deployment Robustness Stress Testing for CT Segmentation Systems Using Clinically Motivated Multi-Corruption Augmentation


440. CodeCytos: AI-assisted spatial molecular imaging analysis via code-augmented agent action space


441. On the Limits of LLM Adaptability: Impact of Model-Internalized Priors on Annotation Task Performance


442. Short-form Text Rewriting with Phi Silica


443. When Safe Skills Collide: Measuring Compositional Risk in Agent Skill Ecosystems


444. GeoSAM-3D: Geodesic Prompt Propagation for Open-Vocabulary 3D Scene Segmentation from Monocular Video


445. DarkVesselNet: Multi-Modal Remote Sensing and Trajectory Reasoning for Dark Vessel Detection


446. Detect Before You Leap: Mirage Detection in Vision-Language Models


447. Finer Parameter Steps for Low-Rank PEFT: A Controlled Study with CP Tensor Adapters


448. AgentxGCore: Agentic AI for Next-Generation Mobile Core Network


449. Masking Stale Observations Helps Search Agents – Until It Doesn’t: A Regime Map and Its Mechanism


450. A Distribution-Free Framework for Rewrite-Based Human-text Detection via Knockoff Filtering


451. PR2: Predictive Routing Replay for MoE-Based LLM Reinforcement Learning


452. Detector-Evasive LLM Paraphrasing via Constrained Policy Optimization


453. Zamba2-VL Technical Report


454. SUPREME: A Multi-GPU Framework for Reproducible Image Unlearning Method Evaluation


455. Agentic Authoring of Interactive Multiview Visualizations in Genomics


456. Reinforcement Learning with Pairwise Preferences in Long-Term Decision Problems


457. Drift Q-Learning


458. (HB-ARFM) History-Bootstrapped Flow Matching for Inverse Boiling Reconstruction


459. ROGUE: Misaligned Agent Behavior Arising from Ordinary Computer Use


460. Isolating LLM Lexical Bias: A Curation-Free Triangulated Metric for Preference-Stage Learning


461. LLMs Need Encoders for Semantic IDs Too


462. DRL-Based Pose Control for Double-Ackermann Robots Under Actuation Uncertainties


463. How Generation Architecture Shapes Code Complexity in Multi-Agent LLM Systems: A Paired Study on HumanEval


464. Rethinking the Role of Temperature in Large Language Model Distillation


465. Bridging Reasoning Trajectories in On-Policy Distillation via Near-Future Guidance


466. Real2SAM2Real: Generative 3D Caches as Complementary Context for Video Diffusion


467. Synthetic Data from Cross-Domain Events for Large-Scale Recommendation Systems


468. Hyperbolic and Evidence-Prioritized Experts for Large Vision-Language Models


469. StressDream: Steering Video World Models for Robust Policy Evaluation and Improvement


470. When Softmax Fails at the Top: Extreme Value Corrections for InfoNCE


471. ARCA: Adapter-Residual Credit Assignment When Token Signals Degenerate


472. Effects of Varying LLM Access on Essay Writing Behavior


473. InfoAtlas: A Foundation Model for Zero-Shot Statistical Dependence Estimate


474. Civilizational Metamaterials: Engineering Coordination Under Capability Gradients and Structural Turbulence


475. Continuous Reasoning for Vision-Language-Action


476. SEMBridge: Tagless-Final Program Semantics with Weakest-Precondition and Bounded-Checking Interpretations


477. From Rashomon Theory to PRAXIS: Efficient Decision Tree Rashomon Sets


478. BAGEN: Are LLM Agents Budget-Aware?


479. Learning to Construct Practical Agentic Systems


480. Agentic Transformers Provably Learn to Search via Reinforcement Learning


481. The New Social Image: How AI Competency and AI Proactivity Influence Self- and Peer-Perceptions in the Workplace


482. Beyond Augmentation: Score-Guided Pathological Prior for EEG-based Depression Detection


483. MyoSem: Aligning Electromyography to Natural-Language Action Semantics for Hand Action Understanding


484. UF-AMA: A unified framework for cross-domain emotion recognition via adaptive multimodal alignment


485. ChurnNet: A Optimized Modern AI for Churn Prediction


486. Improving IoT Intrusion Detection Through SMOTE-Based Oversampling and Extended Multi-Model Evaluation on Side-Channel Power Data


487. DataShield: Safety-degrading Data Filtering for LLM Benign Instruction Fine-Tuning


488. Digital-to-Physical Transfer of Adversarial Patches for Aerial Vehicle Detection


489. Interpreting FCDNNs via RG on Exponential Family


490. A physics-informed foundation model for quantitative diffusion MRI


491. A Protocol-Language Model for Network Intrusion (Without Deep Packet Inspection)


492. Benchmarking Multimodal LLMs on Code Generation for Complex Interactive Webpages


493. DiffCrossGait: Trajectory-Level Alignment for 2D-3D Cross-Modal Gait Recognition via Latent Diffusion


494. PrivacyPeek: Auditing What LLM-Based Agents Acquire, Not Just What They Say


495. Emergence of Exploration in Policy Gradient Reinforcement Learning via Retrying


496. Persona Attack: Incremental Memory Injection Jailbreak Attack against Large Language Models


497. StemBind: When MLLMs Get Lost Between Rules and Instances in Abstract Visual Reasoning


498. RAFT: Data Refinement and Adaptive Distillation for Domain Fine-Tuning with Alleviated Forgetting


499. Multi-Contrast MRI Motion Correction via Parameter-Informed Disentanglement and Adaptive Experts


500. Completion at the Boundary (CaB): Deployable Switching with Completion-Aware Control under Limited Calibration