전체 AI 논문 - 2026-07-07

1. LLM-as-a-Verifier: A General-Purpose Verification Framework



3. Graph Sparse Sampling: Breaking the Curse of the Horizon in Continuous MDP Planning


4. OptiAgent: End-to-End Optimization Modeling via Multi-Agent Iterative Refinement


5. Evaluating and Understanding Model Editing for Medical Vision Language Models


6. MetaSkill-Evolve: Recursive Self-Improvement of LLM Agents via Two-Timescale Meta-Skill Evolution


7. MoP-JEPA: Hard-Assigned Predictor Mixtures for Stochastic JEPA World Models


8. EvoAgentBench: Benchmarking Agent Self-Evolution via Ability Transfer


9. Reason, Reward, Refine: Step-Level Errors Corrections with Structured Feedback for Physics Reasoning in Small Language Models


10. ClassicLogic: A Knowledge-Driven Benchmark of Classic Puzzle Games for Evaluating Compositional Generalization


11. Rethinking On-Policy Self-Distillation for Thinking Models


12. CP-WSP: A Declarative CP-SAT Framework for Configurable Multi-Constraint Workforce Scheduling


13. AgentGym2: Benchmarking Large Language Model Agents in De-Idealized Real-World Environments


14. The Changing Role of Symbolic Methods in Artificial Intelligence


15. DSpark: Confidence-Scheduled Speculative Decoding with Semi-Autoregressive Generation


16. TacReasoner: A Dynamic Tactile-Language Framework for Interactive Reasoning in Real-World Scenarios


17. ASSEMCAD: Production-Ready CAD Assembly Generation from Natural Language


18. Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization


19. Toward Trustworthy Large Language Model Agents in Healthcare


20. Quantum-Inspired Harmonic Decision Models: A Computational Framework for Music Generation


21. STAPO: Selective Trajectory-Aware Policy Optimization for LLM Agent Training


22. Medi-Gemma: A Hybrid Clinical Decision Support System Integrating Deterministic EMR Analytics and Retrieval-Augmented Generation


23. CARL: Constraint-Aware Reinforcement Learning for Planning with LLMs


24. AgenticPD: A Stage-Aware Agentic Framework for Physical Design QoR Optimization


25. FM-ChangeNet: Learning Change through Pathwise Feature Transport


26. FORGE: Research-Trajectory Hijacking Attacks on Deep Research Agents


27. Integrated Altruistic and Fairness Preference Induces Advanced Mutual Cooperation in Sequential Social Dilemmas


28. Formal Disco: Scalable Open-Ended Generation of Formally Verified Programs


29. MRMS: A Multi-Resolution Memory Substrate for Long-Lived AI Agents


30. Governed Individuation: Cryptographically Decoupling an Agent’s Learning from Its Authority


31. Attention Limited Reward Learning


32. Detecting Answer-Driven Reasoning in LLM-Based Educational Tutors via Truncated Chain-of-Thought Auditing


33. Heaviside Continuity of Rolling Coefficients for Eliminating Epistemic Entropy in Large Language Models


34. Measuring Harness-Induced Belief Divergence in Multi-Step LLM Agents


35. VLA Grounder: Language-Conditioning Space Optimization for Black-Box VLA Models


36. Compressing the Validation Bottleneck: An Agentic Self-Driving Lab for Scientific Discovery


37. Why Pure Reasoning is Not Enough: Nature as the Source of Mathematical Innovation


38. ResearchStudio-Idea: An Evidence-Grounded Research-Ideation Skill Suite from ML Conference Outcomes


39. Agent Step Value: State-Transition Measurement with State-Grounded LLM Evaluators


40. LLM-as-a-Tutor: Policy-Aware Prompt Adaptation for Non-Verifiable RL


41. MechMath Agent Team: LLM Driven Agents for Mathematical Research


42. Decentralized Aggregation of LLM Predictions via Wagering Mechanisms


43. Nemotron-Labs-3-Puzzle-75B-A9B: Compressing Hybrid MoE LLMs


44. Server-side Anti-cheat in FPS games for Aimbot detection using Deep learning and Machine learning


45. Do GUI Agents Believe Their Eyes? Diagnosing State-Belief Reliance on Pixels versus Structure


46. HAS-Bench: Evaluating LLM-Based Human-Agent Systems under Configurable Human Participation


47. Agentic SABRE: An Uncertainty-Aware Neuro-Symbolic Multi-Agent Framework for Adaptive Ransomware Detection



49. Progress- and Reliability-Oriented Group Policy Optimization for Agentic Reinforcement Learning


50. Biological Motifs for Agentic Control


51. Unsupervised Features Mining via Activation Geometry


52. Agentic IoT: Architectures, Applications, and Challenges Toward the Internet of Agents


53. A Clustering-Based Framework for Identifying Suspicious Trading Patterns in Capital Market



55. Forethought: Verifiable Reasoning from Neurosymbolic Primitive Programming


56. PLACEMEM: Toward a Compute-Aware Memory Plane for Lifelong Agents


57. What is Left for Us? Second Scholarship Against the Degradation of Research by AI



59. Online Linear Programming for Multi-Objective Routing in LLM Serving


60. Harness-Aware Self-Evolving: Co-Evolving Model Weights, Harness, and Task Solutions


61. Evaluating LLM Uncertainty in Long-Form Generation Using Deterministic Ground Truth


62. Folding, Reasoning, and Scaling with Open-source Drug Discovery Engine


63. Bridging Interleaved Multi-Modal Reasoning as a Unified Decision Process


64. Can Conversational Temporal Dynamics Improve Depression Detection in Dyads? A Preliminary Investigation in Multi-Modality Perspectives


65. Explainable Reinforcement Learning for Adaptive Traffic Signal Control


66. Agent Reinforcement Learning via Pivotal-Aware Self-Feedback Retry


67. Robust Feasible Route Construction through Collaborative Partition Optimization


68. The Role of Rigor in Artificial Intelligence


69. How to Avoid Debate: Scalable AI Safety via Doubly-Efficient Interactive Proofs


70. Applying Answer Set Programming with Fuzzy Membership Functions: a Case Study


71. MentalThink: Shaping Thoughts in Mental SVG World


72. Demonstrating Generalization Failures via Mixtures of Conditional Policies


73. Personalized Causal Recourse: A Human-In-The-Loop Approach


74. Efficient bias mitigation in T2I diffusion models using Concept Graphs


75. From Mobile Data to Business Insights: An End-to-End Analytics Framework for Large-Scale Urban Mobility Analysis and Decision Support


76. When Aggregate Alignment Misleads: Auditing Policy Repair Without Per-State Expert Actions


77. Reflective Dialogue or Prompt Refinement? Effects of Tutor Scaffolding on Students’ Independent LLM Use for Programming


78. Embodied Operators and Benchmarking: Toward Reusable and Deployable Embodied Intelligence Systems


79. Organizational Memory for Agentic Business Process Execution


80. APeB: Benchmarking Personalization Ability of Large Language Model Agents


81. Silicon Sampling via Cross-Survey Transfer


82. Human-Centric Reflective Architecture for Human-AI Collaborative Decision-Making


83. Beyond Forecasting: The Belief-to-Trade Layer in Prediction-Market Agents


84. Reinforcement Learning for Evidence-Seeking Diagnostic Reasoning with Large Language Models


85. Evaluating Generative Agents with Actions Grounded in Socially Distributed Task Environments using Incognita


86. A Sliding-Window-Based Reinforcement Learning for Dynamic Assembly Flow Shop Scheduling with Multi-Product Delivery


87. VERITAS: Towards a General-Purpose Replication Tool for Scientific Research


88. Oyster-II: Reinforcement Learning for Constructive Safety Alignment in Large Language Models


89. MedCalc-Pro: Solving Complex Medical Calculations with LLM Agents


90. Object-Centric Environment Modeling for Agentic Tasks


91. SwarmResearch: Orchestrating Coding Agents for Open-Ended Discovery


92. Automated Data Readiness for Scientific AI


93. ASK in the Dark: Uncertainty-Gated LLM Assistance under Partial Observability


94. Internal Pluralism and the Limits of Pairwise Comparisons


95. iFLYTEK-Embodied-Omni Technical Report


96. From Fixed to Free Cameras: Calibration-Free View-Robust Vision-Language-Action Model


97. Weak-to-Strong Generalization via Direct On-Policy Distillation


98. Interpretable Human-Label-Free Deep Learning for Real-Bogus Classification with Uncertainty Quantification


99. Search Beyond What Can Be Taught: Evolving the Knowledge Boundary in Agentic Visual Generation


100. What Does a Discrete Diffusion Model Learn?


101. Cortex: A Bidirectionally Aligned Embodied Agent Framework for Long-horizon Manipulation


102. GaP: A Graph-as-Policy Multi-Agent Self-Learning Harness For Variational Automation Tasks


103. SPEARBench: A Benchmark for Naturalness Evaluation in Streaming Speech-to-Speech Language Models


104. REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing


105. Selective Disclosure Watermarking for Large Language Models


106. Multiplayer Interactive World Models with Representation Autoencoders


107. TREK: Distill to Explore, Reinforce to Refine


108. Steering Optimisation Trajectories in Diffusion Representation Learning


109. Topological Shape Representation for Aneurysm – Bifurcation Detection


110. Air Quality Downscaling with Station-Guided Pseudo-Supervision


111. Wavelet Scattering Transform for Interpretable Schizophrenia Biomarker Discovery and Classification from Resting-State EEG


112. ProPS: Prompted Profile Synthesis for Natural Language-Conditioned Speaker Embedding Distributions


113. Adaptive Inference Batching using Policy Gradients


114. Shifting from Discrete to Continuous Reference Data: QSM-Derived Horizontal Tree Biomass Distribution for Deep Learning Biomass Estimation


115. Privacy-Preserving Robustness Verification for Neural Networks


116. CanniUplift: A Holistic Framework for Mitigating Seller and Incentive Cannibalization in E-commerce Uplift Modeling


117. Optimizing ML Workload Partitioning between CPUs and CIM Accelerators for Heterogeneous Computing


118. Noisy-Channel Minimum Bayes Risk Decoding


119. Unified Audio Intelligence Without Regressing on Text Intelligence


120. When Claws Remember but Do Not Tell: Stealthy Memory Injection in Persistent Personal Agents


121. Relational Multi-Agent Reinforcement Learning for Dynamic Pricing in High-Speed Railway Markets


122. Open Problems in AI Incident Governance


123. PDEFlow: Autonomous Agentic PDE Pipelines for Neural Operator Learning and Solver-Free Inference


124. Three-Phase Evaluation of AI-Assisted Software Development Life Cycle


125. Agent Data Injection Attacks are Realistic Threats to AI Agents


126. Localized LoRA-MoE: Block-wise Low-Rank Experts With Adaptive Routing


127. Grokking Is Conditional and Fragile: A Fully-Tractable, Multi-Seed Study at 12K Parameters


128. AIFS-SUBS: Extending Data-Driven Forecasting to Sub-Seasonal Timescales


129. Beyond Independent Labels: Schwartz-Geometry Decoding for Human Value Detection


130. RUFNet: Query-Guided Support Mask Refinement and Uncertainty Fusion based on Hybrid Mamba for Few-Shot Brain Tumor Segmentation


131. LLM-Based Test Oracles: Source-of-Authority Taxonomy – A Systematic Literature Review


132. Your Agent’s Memories Are Not Its Own: Forged Reasoning Attacks on LLM Agent Memory and Defenses


133. Hyperparameter Transfer in Graph Neural Networks


134. ImputeECG: Deep Learning Reconstruction of Complete 12-Lead Electrocardiograms from Incomplete Recordings for Cardiac Assessment


135. Comparison of Loss Functions for Robust Deep Learning-based Echocardiography Segmentation when Learning with Partially Labelled Data from Multiple Domains


136. TACTIC-KG: Toward Small Agent Teams for Cyber Threat Intelligence Knowledge Graph Construction


137. The Map Behind the Flow: Finite-Step Gradient Descent as a Dynamical System


138. LLM for the development of FCM


139. Joint Velocity Slope Diffusion Prior for Structurally Constrained Velocity Model Building


140. Multi-Robot Open Adaptive Teaming Across Unseen Environments, Partners, and Scales


141. MemPose: Category-level Object Pose Estimation with Memory


142. DSWAM: A Dual-System World Action Foundation Model for Fine-Grained Robot Manipulation


143. Input Pathways Shape Few-Shot, Not Zero-Shot, Binding in Tiny Transformers: A Fully-Enumerable Study


144. Efficient Perception in Automotive Detection and Tracking Using Neuromorphic Computing


145. Graph Representation Learning of Longitudinal Medical Imaging Trajectories for Treatment Response Prediction


146. EventCoT: Event-centric Video Chain-of-thought for Reasoning Temporal Localization


147. SynSFX: Multi-Model Sound Effects Synthesis Dataset for Deepfake Detection and Evaluation


148. Pretraining Curricula Enable Selective Fine-tuning



150. Evaluating the Effect of Linguistic Relatedness on Cross-Lingual Transfer in Large Multilingual Automatic Speech Recognition


151. An Exploration of Agentic Information Fusion for Test Maintenance Prediction


152. Predicting Drafted Deck Strength for “Magic: the Gathering”


153. Multi-Turn On-Policy Distillation with Prefix Replay


154. Trust Region Policy Distillation


155. Wasserstein Residuals: Learning Gradient Flows from Population Dynamics


156. RustMizan: A Compilable, Contamination-Aware Benchmarking Framework for Rust Vulnerabilities


157. Turning Off-Policy Tokens On-Policy: A Plug-in Approach for Improving LLM Alignment


158. Dashboard2Code: Evaluating Multimodal Models on Reconstructing Interactive Dashboards


159. Geometry-Aware Motion Latents for Learning Robust Manipulation Policies


160. RSPO: Reward-Swap Policy Optimization for Multi-Turn LLM Agents


161. Strategic Buying Agents


162. URSA: Chemistry-Aware Benchmark for Utilitarian Retrosynthesis Assessment


163. ToolFailBench: Diagnosing Tool-Use Failures in LLM Agents


164. Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning


165. Elastic Gang: Per-Token Membership Change for a Hard-Barriered LLM Inference Gang Co-Scheduled with OS Processes


166. Targeted Structure Completion for Sparse-View 3D Reconstruction in Autonomous Driving


167. Machine Learning for Depression Screening and Intervention: an Original Circadian Rhythm Score-based Methodology


168. Retroactive Chain-of-Thought (RetroCoT): Forensic Reconstruction Prompts as a Safety Diagnostic Across Model Generations


169. Hierarchical Evidence-Driven Reasoning for Long Document Understanding


170. SILO: Simulation-in-the-Loop Sim-to-Real Transfer for Multi-Stage Cable Routing


171. G2VD: Generalizable AI-Generated Video Detection via Counterfactual Intervention and Causal Disentanglement


172. Do All Visual Tokens Matter Equally? Object-Evidence Preserving Token Merging for Vision-Language Retrieval


173. LCPNet: Latent Consistent Proximal Unfolding Network for Infrared Small Target Detection


174. TORINO: Token Reduction via Interpretable Concept Overlap in Vision-Language Models


175. Simple-to-Complex Structured Demonstrations for Vision-Language-Action Learning


176. LLM-Driven CI-CD Workflow Intelligence for Cyber Systems Engineering


177. A Few Teacher Steps Go a Long Way: Cost-Efficient On-Policy Data Augmentation for Agent Post-Training


178. EEG-SpikeAgent: Agentic Closed-Loop Program Synthesis for Automated EEG Spike Detection


179. Predicting Therapeutic Outcome via Aligning Patient-Specific Knowledge Graph and Gene-Level Perturbation Representations


180. Lights, Camera, Carbon: Architectural Scaling Laws for Video Generation Energy Consumption


181. Explainable Novel Category Discovery in Semantic Concept Space


182. Mask2Real-WM: Segmentation Masks as a Sim-to-Real Bridge for Controllable Dexterous World Models


183. Auto: The AGI Compiler


184. CRISP: A Spatiotemporal Camera-Radar Backbone for Driving via Forecasting-Based World-Model Pretraining


185. Obey, Diverge, Collapse: Blind Obedience to Incorrect Instructions Drives Code LLMs to Irrecoverable Code Semantic Collapse


186. Lyapunov-Guided Training for Hardware-Safe Neural Networks Under Fixed-Point Arithmetic


187. Training-Free Model Selection and Domain-Aware Score Calibration for First-Shot Anomalous Sound Detection


188. Language Models Represent and Transform Concepts with Shared Geometry


189. Failures and Successes to Learn a Core Conceptual Distinction from the Statistics of Language


190. Transplanting, inverting, and preventing a misalignment persona: method-conditional emergent misalignment in Qwen2.5


191. Two Black Boxes, One Solver: Encoder Probing and Decoder Attribution for Neural Multi-Attribute VRP under Hard-Mask and Recourse Decoders


192. PulmoSight-XAI: An Explainable Multi-View Attention Ensemble with Gradient Boosting Meta-Learning for Multi-Label Chest X-Ray Classification


193. Regime-Conditional Stabilisation of LLM-Augmented Cooperative Multi-Agent Reinforcement Learning


194. Operator-on-F complements value-equivalence: a planning-time diagnostic for latent world models


195. Robustness Verification of an Autonomous Underwater Vehicle-based Plankton Classifier


196. A Deep Learning-based surrogate model for Severe Accidents in nuclear reactors using ASTEC


197. From Regulation to Requirements: An Automated Requirement Derivation and Explanation Pipeline


198. Wan-Streamer v0.2: Higher Resolution, Same Latency


199. Generative wave propagator


200. ResearchStudio-Reel: Automate the Last Mile of Research from Paper to Poster, Video, and Blog


201. A Retrieval-Augmented Framework for Detecting and Resolving Pragmatic Ambiguities in Natural Language Requirements


202. RoboDojo: A Unified Sim-and-Real Benchmark for Comprehensive Evaluation of Generalist Robot Manipulation Policies


203. Covert Trait Propagation Is Representation Alignment: Mechanistic Evidence from Hidden-Channel Distillation


204. On Pairwise Quantile Regression – Statistical Guarantees and Applications


205. evalci: A Python Library for Statistically Rigorous Comparison of Language Model Evaluations


206. dOPSD: On-Policy Self-Distillation for Diffusion Language Models


207. UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning


208. Transferability Between Understanding and Generation in Unified Multimodal Models


209. Full-Stack FP4: Stable LLM Pretraining with Quantized Projections, Optimizers, and Attention


210. Auto-AEG: Scalable Data Construction for Open-Vocabulary Audio Event Grounding


211. HASSL: Hierarchy-Aware Self-Supervised Learning Framework for Single Cell Microscopy


212. IRIS: An Intelligent Vision-Language System for Ocular Surface Diseases via Topic Tree and Scene-Driven VQA Generation


213. One Framework for All: Cross-Modal Membership Inference for Generative Models


214. Fixed-Confidence Best-Arm Identification for Causal Mediation Analysis


215. HiFA4: Training-Free 4-bit FlashAttention on Ascend HIF4 NPUs for LLM Inference


216. CausalGame: Benchmarking Causal Thinking of LLM Agents in Games


217. Agentic-V2X: Small Language Model Agents for Deadline-Aware V2X Scheduling in 5G/6G Networks


218. Risk-Constrained Freshness-Aware Semantic Caching for Open-Web Retrieval-Augmented LLMs


219. Self-Reference in Large Language Models: The Introspection Threshold for Recursive Self-Improvement


220. LBR: Towards Mitigating Length Bias in Large Language Models for Recommendation


221. HALO-WA: Hybrid-Attention Latent-Guided Online Reinforcement Learning for World-Action Models


222. Signal or Noise? Understanding Generative Models for Real-World Sensor Time Series


223. Hierarchical Multi-to-Single-Modal Knowledge Distillation for Disruption Prediction in EAST


224. SoftVTBench: A Safety-Aware Visuo-Tactile Benchmark for Physically Constrained Robotic Manipulation of Deformable Objects


225. Detecting Hallucinations in Retrieval-Augmented Generation through Grounding-Aware Sensitivity by Perturbation (GASP)


226. CritiqueDriveVLM: From Verifier-Guided Reinforcement Learning to Latent Thought Distillation for Autonomous Driving


227. Piercing Gilbreath’s Conjecture: From Deep Number Theory Insights to Fintech and Cybersecurity


228. SeeMe: Mitigating Hallucinations in Large Vision-Language Models through Effective Visual Token Engineering


229. Information-Geometric Superposed Vowel Evaluation: Part 1. Moraic Syllabary (Japanese)


230. Mask-based Predictive Representations for Reinforcement Learning


231. HCSU: A Dataset and Benchmark for Fine-Grained Historical Calligraphy Style Understanding


232. !Imperio, smolVLA: The Implications of Data Poisoning on Open Source Robotics


233. CSB: A Counting and Sampling tool for Bit-vectors


234. Conflict-Based Lazy Search for Fast Multi-Manipulator Planning


235. SOV-CAD: Stepwise Orthographic Views Guided CAD Modeling Sequence Reconstruction


236. Parametric Memory Decoding for Zero-Shot Routing in LoRA-Based External Parametric Memory


237. DynaVieW: Schema-Guided World Modeling for Understanding Hierarchical Visual Dynamics


238. Submitted and Diagnostic Analysis of Full-Text Temporal Retrieval for LongEval-Sci


239. FedSPM: Routing-Enabled Federated Learning under Dual Heterogeneity via Semiparametric Mixture


240. Seeing Once is Enough? Online Geometry-Aware Token Pruning for 3D Question Answering


241. Benchmarking API Drift in LLM-Generated Quantum Code Across Successive SDK Versions


242. Beyond Multilingual Averages: MTEB-PT, a Benchmark for Portuguese Sentence Encoders


243. Enhancing Implicit Neural Representations with Image Feature Embedding for Unsupervised Cardiac Cine MRI Reconstruction


244. Speaker-Disentangled Chunk-Wise Regression for Syllabic Tokenization


245. Telescope: Improving Zero Shot Detection of LLM Generated Content By Measuring Token Repetition Probability


246. Reward-Gated On-Policy Distillation


247. The “I Don’t Know” Filter: Enhancing Agentic Reliability in Function Calling


248. OmniOpt: Taxonomy, Geometry, and Benchmarking of Modern Optimizers


249. Efficient Discovery of Conditional Dependencies with Desbordante


250. A Unified Algebraic Framework for Classification Performance Evaluation


251. Finite Reliability Representations: Noise-Calibrated Belief-Space Covers for Reliable Decision-Making


252. When Does Small Data Work? Accuracy and Efficiency Trade-offs Between Tabular Foundation Models and Conventional Methods for Crowd-State Classification at Hajj and Umrah


253. Separating Representation from Reconstruction Enables Scalable Text Encoders


254. Full Glyph Images Beat Token Embeddings: A Controlled Study for Transformers


255. NouveauVoice: Generating Novel Pseudo Speakers for Voice Anonymization


256. BanglaMemeEvidence: A Multimodal Benchmark Dataset for Explanatory Evidence Detection in Bengali Memes


257. Scalable Semantic Steering of Embedding Projections


258. Order-based Causal Discovery for Multistage Processes


259. Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents


260. Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Action Control


261. NormWorlds-CF: Solver-Verified Counterfactual Normative Reasoning with Metamorphic-Relation GRPO


262. The Remarkable Effectiveness of Providing AI Agents with Natural Language Tools: A Replication Study Validating NLT Performance Across 14 Models


263. Why3-py: A Tool for Formal Verification of Hypothesis Testing and Meta-Analysis in Python


264. MPSelectTune: Prompt-type Selection for Fine-tuning improves Concept Unlearning in LLMs


265. Probe, Don’t Prompt: A Hidden-State Probe for Metadata Filtering in Multi-Meta-RAG


266. TokAN: Accent Normalization Using Self-Supervised Speech Tokens


267. TabQueryBench: A Query-Centric Benchmark for Synthetic Tabular Data


268. Advanced Topic Modeling Techniques for Categorizing Software Vulnerabilities


269. Enhancement of E-commerce Sponsored Search Relevancy with LLM


270. Consistent but Miscalibrated: Evaluating LLM Limitations for Risk Communication in Natural Language


271. Next-Gen Sponsored Search: Crafting the Perfect Query with Inventory-Aware RAG (InvAwr-RAG) Based GenAI


272. GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Segmentation


273. High-Fidelity One-Step Generative Visuomotor Policy via Recursive Correction, Frequency Consistency, and Contrastive Flow Matching


274. When Simpler Is Better: Evaluating Translation Pipelines for Medieval Latin Manuscripts


275. Beyond Static Rules: Automated Discovery of Latent Vulnerabilities in Text-to-SQL


276. How Do Diffusion Classifiers Decide? A Bias-Centric Evaluation


277. Q-TriM: Question-Guided Tri-Modal Attention for Audio-Visual Question Answering


278. DualView: Preventing Indirect Prompt Injection in Personal AI Agents


279. CGGS: Consistency-Augmented Geometric Gaussian Splatting for Ego-centric 3D Scene Generation


280. Probing Low-Level Acoustic Attribute Encoding in CLAP Audio Embeddings


281. CineMobile: On-Device Image-to-Video Diffusion for Cinematic Camera Motion Generation


282. Punching Above Their Weight: Classification-Head Fine-Tuning of Tiny Language Models (TLMs) for Verifiable Multiple-Choice Tasks


283. Foundations of Equivariant Deep Learning: Unifying Graph and Sheaf Neural Networks


284. Rethinking Depth Pruning for Vision Transformers: A Heterogeneity-Aware Perspective


285. SkillFab: An Agent-Native Skill Production Platform


286. Self-Improving Diffusion Classifiers with Minority Preference Optimization


287. FedACT: Federated Adaptive Coordinate Trust Modulation for Robust Transformer Training under Data Heterogeneity


288. EmCom-Diffusion: Probing Visual Reflection in Emergent Languages via Image Generation


289. A Failure-Mode Benchmark for Polymorphic Sybil Poisoning in RAG


290. Attending to Multimodal Generation One Token at a Time


291. CoGen3D: An Agentic Human-AI Co-Design Pipeline for 3D Asset Generation for Virtual Reality


292. OmniTacTune: Policy-Agnostic Real-World RL for Tactile Residual Adaptation of Visual Policies


293. Don’t Blame the Large Language Model: How Scaffolding Evolution Shapes Coding Agent Quality


294. Phase-Preserving Trimodal Transformer for Tropical Forest Biomass Estimation Using Optical and PolInSAR Data


295. A Fair Benchmarking of Deep Relational Database Learning Models


296. ViPo-MLLM: Visual-Pose Multimodal LLM for Gloss-Free Sign Language Translation


297. AutoCedar: An Agentic Framework for Verifier-Guided Access Control Policy Synthesis


298. ELiTeFormer: An Efficient Transformer for FPGAs


299. ClinOCR-Bench: A Comprehensive Clinical Scanned Document Dataset for Optical Character Recognition Model Evaluation


300. Moonstone: A Multimodal Foundation Model and Benchmark for Lunar Remote Sensing


301. Revealing Hidden Model Behaviors with Task-Specific Self-Reports


302. An AI-Assisted Solution to the Signed BAR Conjecture: Uniqueness in the Harrison–Reiman Class and a Completely-$\mathcal{S}$ Class Obstruction


303. RADIO1D: Elastic Representations for Condensed Vision Modeling


304. A Step Towards Robust Unsupervised Domain Adaptation via Fine-Tuning and Reinforcement Learning


305. They Infer What You Meant: Models Represent Communicative Intent More Reliably Than They Act On It


306. Token-Based Affordance Grounding with Large Vision-Language Models


307. An Interpretable Deep Learning Framework for Discovery and Clinical Validation of Deep Radiomic Signatures in Tumor Classification


308. Responsibility Distribution Estimation in Ego-View Accident Videos with Multimodal Large Language Models


309. PLGSA-Transformer: Periocular Landmark-Guided Attention with Occlusion-Adaptive Cosine Thresholding for Cross-Modal Masked and Unmasked Face Recognition


310. Differentiate the Evaluator, Not the Program: An Efficient Runtime Representation for Neuro-Symbolic Learning


311. Teacher Supervision over Representation Equivalence Classes


312. EPRA U-Net: An Efficient Pyramid Residual Attention Framework for Accurate Infarct Segmentation in Diffusion-Weighted MRI


313. Latent Clarity: Bridging World-Model Kinematics to Semantic Manifolds for Video Anomaly Anticipation


314. Aligning Language Models with Selective Prediction


315. AGL-1: The Enterprise AI Governance Layer as a Control Plane for Trusted Enterprise Intelligence


316. CAGE-1: Control, Assurance, and Governance Evaluation for Enterprise Agentic AI


317. Reading Between the Dots: Decoding Hidden Computation across Filler Tokens


318. STRATOS: Bridging the Symbolic-to-Numeric Gap in Spatio-Temporal Text-to-SQL for Meteorological Data


319. Towards Diverse and Comprehensive Benchmarks for Mutual Information Estimation


320. CaresAI at SMM4H-HeaRD 2026: Predicting TNM Staging


321. Best-of-Better-$N$: Generating Pre-Aligned Responses with In-Context Learning


322. SkillOpt-Lite: Better and Faster Agent Self-evolution via One Line of Vibe


323. HiMe: Hierarchical Embodied Memory for Long-Horizon Vision-Language-Action Control


324. TRIAGE: Trustworthy Retrieval Instrumentation And Graph Evaluation


325. No Time Like the Present: Agentic Test-Time Training for LLM Agents


326. Amortising Bayesian Experimental Design for Sequential Information Gathering in LLMs


327. Securing Multi-Tool AI Agent Chains With Dynamic, Real-Time Compositional Policies


328. DETECT-3B-Omni is Agnostic of Content and Demographics


329. The S-ICDF Dataset: Sionna-Simulated Dynamic Interference Characterization and Direction Finding


330. Spectral Signatures of Large Language Models


331. Brand-as-Memory: Vision-Language Models Encode Causal, Mechanistically Localizable Credibility Priors for News Sources


332. LLM-Enhanced Hierarchical Heterogeneous Graph Representation Learning for Malicious Python Package Detection


333. PedestrianDiffusion: Multimodal Generative Denoising and Dense State Estimation for Inertial Navigation


334. Efficient Decentralized Multi-task Dataset Valuation via Model Merging


335. FedAvg for HAR: Exploring the Tradeoff Between Personalized and Generalization Accuracy


336. SPORK: Self-Speculative Forking to Accelerate Agentic LLM Inference



338. Hierarchical Multi-Agent Reinforcement Learning for Carbon-Aware AI Data Centers in Power Distribution Systems


339. Is Agentic Code Review Helpful? Mining Developers’ Feedback to CodeRabbit Reviews in the Wild


340. A harmonised dataset for Earth system foundation models


341. Semantic Segmentation-Driven Image-Level Diagnosis of Liver Cancers in Hematoxylin and Eosin Histopathology Images


342. Unbiased Alignment for Large Language Models with Noisy Preferences


343. Agentic and Generative AI for Open-Source Intelligence and Cyber Investigations: Taxonomy, Evaluation, Challenges, and Future Directions


344. CONTRA: Red-Teaming Configurations of Personalizable Agents


345. Builder, Defender, Breaker: The Case Against Removing the Human from the AI-Driven Security Lifecycle


346. OpenGlass: A Sensing-Computing Split Architecture for Local MLLM-Driven Real-Time Visual Assistance


347. Transition Information Density: Morphological Trajectories, Synesthetic Perception, and Structured Interpolation in Neural Training (or: The Synesthetic AI)


348. Self-Specializing Vision-Language Transmon Chip Calibration in a Physics-Grounded Environment


349. A Bayesian Framework for Evaluating Scenario Compatibility in Generative Population Synthesis


350. Scalable Maximal Frequent Episode Mining with Desbordante


351. AnchorVLA: Bridging Discrete Decisions and Continuous Trajectories for Vision-Language-Action Planning


352. Teaming Up with AI: Coordination and Cooperation


353. CRRL: A Causality-Based Reinforcement Learning Framework for Autonomous System Recovery


354. Effectiveness of LLM-based Software Diversity for Reliability Improvement – an Empirical Study


355. Decentralised Federated Learning over Temporal Networks: The Role of Heterogeneities


356. KARMA: Knowledge graph-based Automated Reasoning Materialization and Alignment


357. The Role of Prompt Language and Translation-Theory-Driven Prompts in Large Language Models: A Case Study on Spanish-Chinese Journalistic Translation


358. Which Algorithm Specification Formats Help Language Models Implement Machine Learning Algorithms?


359. Conditional Diffusion Guided Knowledge Transfer for Multi-Domain Knowledge Graph Completion


360. Rethinking Neural Nonlinearity as Gating


361. CuBAS: Information Geometric Curvature-Based Adaptive Sampling for Supervised Classification


362. Text as Partial Constraint: Core-Residual Alignment for Robust Vision-Language Learning


363. Detecting Architectural Drift in Safety-Critical Firmware through Runtime Trace Analysis


364. A Multi-Task Deep Learning Framework for Real-Time Intelligent Video Surveillance with Temporal Event Validation


365. ACPO: Adaptive Credit Policy Optimization via Fine-Grained Surrogate Entropy


366. SNR-Adaptive Unified Diffusion for Multi-Task Medical Image Segmentation


367. Flow-A11y: Flow-Aware Accessibility Testing


368. Don’t Wait to Reply: Towards Responsive yet Thoughtful Dialogue through Proactive Thinking


369. STELLA: Efficient Sensor-to-LLM Translation for On-Device Human Activity Recognition


370. Attention-Guided Efficientnet Architecture For Precise Criminal Identification in Surveillance Images


371. PixCon: Clean-Positive Contrastive Learning for Foundation-Model Semi-Supervised Segmentation


372. Spectral Rewiring for Exploration, Purification, and Model Merging


373. LACE-SVD: Loss-Aware SVD with Cumulative Error Correction for LLM Compression


374. OmniFocus: Query-Guided Modality-Balanced Token Compression for Omni-Modal Large Language Models


375. MambaLIE: Scene Light Intensity-Boosted Low-Light Image Enhancement with State Space Model


376. HyperVAttention: Efficient Sparse Attention with Spatio-Temporal Clustering for Video Diffusion


377. Can Model Merging Improve Aggregation in DiLoCo?


378. Back to Basics: Improving Molecular Understanding in LLMs via SMILES-Graph Translation


379. PosterHarness: Turning Scientific Poster Generation into an Auditable Instruction-Following Benchmark


380. CONFLUX: A Latent Diusion Model for 3D Chest-CT Synthesis with RL Post-Training


381. VISTA: Auditing Semantic Divergence in Vision-Language Models


382. Enhanced Feature Extraction for IoT Network Intrusion Detection Using GNNs and KAN


383. Hierarchical Sparse Attention Done Right: Toward Infinite Context Modeling


384. Individual Parameters in Weight-Sparse Transformers Appear Interpretable


385. Parallelized Autoregressive Decoding for Omni-Modal Dense Video Captioning


386. The Foreign Policy AI Evaluation Gap


387. Pooling-Based Context Modeling for Convolution-Free Deep Image Prior


388. A Precedent-Guided Co-Scientist for Side-Effect-Aware Drug Redesign


389. MatPhaseBench: A Semantics-Guided Benchmark for Materials Phase Diagrams Understanding


390. PromptPET: Privacy-Utility Optimized Prompt Obfuscation


391. Modeling the Impact of Visual Brand Language on Attention, Object Recognition, and Memory Retrieval


392. VideoSearcher: Empowering Video Deep Research with Multi-Tool Agentic Reasoning via Reinforcement Learning


393. R3D: Quantitative 3D Spatial Reasoning for Egocentric Wearables


394. Harmonic-Aware Transformer for Real-Time Catheter Localization in Interventional Procedures of Magnetic Particle Imaging



396. CoACT: Action-Preserving Observation Compression for Coding Agents


397. Learning Taxonomic Trees with Hierarchical Representation Regularization for Large Multimodal Models


398. TIER: Trajectory-Invariant Explanation Regularization for Membership Privacy


399. PPE-Bench: A Benchmark for Evaluating MLLM Unlearning under Private-Public Entanglement


400. SPLIT: Training-Free AI-Generated and Partially Edited Video Detection via Spatial Patch-Level Incoherence and Temporal Roughness


401. Where do LLMs Fall Short in CBT-Guided Affective Reasoning?


402. Determinants and Limits of LLM Security-Tool Orchestration: A Study with HexStrike-AI


403. Differential Amplifier-Inspired AmpAttention for Multi-View Robotic Manipulation


404. JavaVulBench: A Java Vulnerability Benchmark with Realistic Splits, a Unified Multi-Backend Harness, and a Leakage-Aware Evaluation Mode


405. Vision Token Manipulation Attacks on Cloud-Edge Inference of Large Vision-Language Models



407. Training Hybrid Block Diffusion Language Models with Partial Bidirectionality


408. Seduced by the Narrative: Assessing Rule Adherence in Semi-Open Textual Sandboxes


409. A Preliminary Study on Explaining Risk of Code Changes using LLM-Based Prediction Models


410. Safe Inference-Time Alignment via Lagrangian Reward Augmentation


411. Gemma 4 Technical Report


412. Out-of-Distribution Generalization of Risk Aversion in Language Models


413. Echoes of Unrest: A Multimodal NLP Framework for Early Warning of Fake News and Violence-Driven Mob Activity


414. SMOCS: A Streaming Framework for Simplified Deployment, Monitoring, and Optimization of ML Systems in Production


415. Signal from Space: Detecting Schools and Towers to Bridge the Digital Divide


416. Diagnosing Aerial-View Object Detectors with Foundational Image Generative Models


417. Not All Refusals Are Equal: How Safety Alignment Fails Cybersecurity at Scale


418. LLMoxie: Exploring Agentic AI for Scientific Software Development


419. S-EMBER: A Large-Scale Benchmark for Streaming Egocentric Memory Retrieval


420. K9-Bench: Evaluating Multimodal LLMs on Canine-Centric Videos


421. Metronome: Bound the Cache, Keep the Beat for Real-Time Interaction Model Serving


422. Post-Generation Curation of Synthetic Images via Homogeneous-Heterogeneous Splitting


423. Federated Learning for Object Detection: Enabling Collaborative Drone Learning Without Centralizing Data


424. QuantFlow: A Federated Mamba-Based Post-Transformer Foundation Model for Time-Series Forecasting


425. Fine-Grained Computation Offload for Off-the-Shelf Servers in Tens of Lines


426. COMET: Combinatorial Optimization for Multiplex Editing Targets Via Constraint-Preserving QAOA


427. The agent creates, we validate: A Lightweight Framework for Agentic Artifact Generation


428. Fusion: A Framework for Unified Sequential Token AdaptatIon in VisiOn TraNsformers


429. Knowledge-Centric Information Systems


430. AgentLTL: A Trace-Verification Framework for Measuring, Enforcing, and Training Procedural Compliance in Tool-Using LLM Agents


431. An automated method of identifying incorrectly labelled images based on the sequences of loss functions of deep learning networks


432. Homer: Understanding Long-form Videos with Hierarchical Memory and Agentic Reasoning


433. Criterion-Conditional In-Context Learning: Evaluating Criterion-Shift Adaptation in Vision-Language Models


434. From Tensor Buffer to Distributed Memory Hierarchy: A Survey of KV Cache Management for LLM Serving


435. Additive Causal Construction for Transferable and Reconfigurable Cross-System Learning in Multi-Source Image Fusion


436. DOSE-I: A Multimodal Biosignal Dataset of Procedural Sedation for Endoscopy – Technical Report


437. CRODA-ST: Single-Target Cross-Receiver Open-Set Radio Fingerprint Recognition


438. From Raw Segmentations to Simulation-Ready Cardiac Meshes: An Automated Framework for Anatomical Reconstruction and Virtual Cohort Generation


439. Attention Dynamics in Diffusion Models: A Visual Analytics Framework for Human-AI Collaboration


440. Double-Helix Active Geometry: LiDAR-Anchored Multi-View Depth with Selective Abstention


441. DELTAVID: Enhancing Fine-Grained Spatiotemporal Perception with Cross-Video Differences


442. Not Every Sync Is Safe: Calibrated DiLoCo Scheduling for Shared AI Infrastructure


443. The Hidden Water Geography of U.S. Hyperscale Data Centers in the AI Era


444. PEEK: Predictive Queue-Informed KV Cache Management for LLM Serving


445. SWIFT: Spatio-temporal Wavelet Integrated Forecasting Framework for Workload Traces


446. AutoResearch: An Execution-Grounded Multi-Agent Framework for Reliable Research Workflow Automation


447. GLM-5 Serving Parameter Tuning for OpenClaw: Single-Deployment MaaS Inference Optimization for Long-Context Agent Workloads


448. Neural-Network Inverse Design of SRF Cavities and Transmons for Bosonic Quantum Computation


449. Specific Domain Ontology Construction Using Large Language Models


450. PotatoGANs: Utilizing Generative Adversarial Networks, Instance Segmentation, and Explainable AI for Enhanced Potato Disease Identification and Classification


451. SiamixFormer: a fully-transformer Siamese network with temporal Fusion for accurate building detection and change detection in bi-temporal remote sensing images