전체 AI 논문 - 2026-06-30

1. Self-Evolving World Models for LLM Agent Planning


2. DOPD: Dual On-policy Distillation


3. The Human Creativity Benchmark


4. Linguistic Firewall: Geometry as Defense in Multi-Agent Systems Routing


5. Latent Actions from Factorized Transition Effects under Agent Ambiguity


6. Entity Binding Failures in Tool-Augmented Agents


7. The FIL Hypothesis: Inductive Biases Help with Kernel Engineering


8. ENC-ODE: Event-level Neurodegenerative Modeling in Continuous Time with Neural ODEs


9. Whose Side Is Your Agent On? Multi-Party Principal Loyalty in LLM Agents


10. Using Large Language Models as Low-Cost Statistical Estimators for Human-Response Data


11. Sequential Fairness Auditing with Limited Output Access


12. BayesEvolve: Explicit Belief States for Autonomous Scientific Discovery


13. ManimAgent: Self-Evolving Multimodal Agents for Visual Education


14. Rehearsed Multi-Agent Live Product Demonstrations with Real-Time Voice Question Answering


15. PromptGNN-sim: Deep Fusion and Alignment of GNN and LLMs for Text-Attributed Graph Learning


16. EMPATH: A Multilingual Auditor-Judge Benchmark for Safety Evaluation of Emotional-Support Chatbots


17. Inoculation Adapters: Improved Selective Generalization of Capabilities with Fewer Surprising Backdoors


18. Clarus: Coordinating Autonomous Research Agents toward Web-Scale Scientific Collaboration


19. EvalSafetyGap: A Hybrid Survey and Conceptual Framework for LLM Evaluation-Safety Failures


20. The Many-Body Problem of the Data Centre


21. Domain Adaptation with Adaptive Imagination for Visual Reinforcement Learning under Limited Target Data


22. From Detecting Agency to Doing Work: Self-Caused Credit Builds a Durable Behavioral Self in a Minimal Spiking Agent


23. Dynamo: Dynamic Skill-Tool Evolution for Vision-Language Agents


24. MirrorCode: AI can rebuild entire programs from behavior alone


25. FacePlex: Full-Duplex Joint Speech-Facial Motion Generation for Conversational Avatars


26. Relevance Is Not Permission: Warranted Attention for Value Contributions


27. Does Verbose Chain-of-Thought Really Help? In-Distribution Evidence that Content, Not Length, Matters


28. Open Problems in Constitutional Preference Reconstruction


29. Structural Certification for Reliable Physical Design with Language Models


30. Propagation of~Interval Belief Structures and~Imprecise Copulas for~Neural Network Verification


31. Temporal Feature Extractors in EEG Foundation Models: A Controlled Comparison Including a Pretrained Time-Series Model


32. Hierarchical Reinforcement Learning in StarCraft Micromanagement with Influence Maps and Cluster-based Scripts


33. SAT-RTS: A systematic framework for tactical knowledge extraction and visualization-based analysis in real-time strategy games


34. ACPO: Agent-Chained Policy Optimization for Multi-Agent Reinforcement Learning


35. AlgoSkill: Learning to Design Algorithms by Scheduling Human-Like Skills


36. Be Faithful When Response: Returning Fluent and Grounded Answers for Vision-Language Models Reinforcement Learning


37. Exploration and Online Transfer with Behavioral Foundation Models


38. First-Order Temporal Logic Tensor Networks


39. SAGA: Scene-Aware, Goal-Evolving Agents for Long-Horizon CivRealm Strategy Planning


40. HippoSpark: An On-Demand Experience System for LLM Reasoning


41. A causal modeling perspective on decision theory


42. SafePyramid: A Hierarchical Benchmark for In-context Policy Guardrailing


43. AI Training Manager: Bounded Closed-Loop Control of Adaptive Training Recipes


44. Beyond Triplet Plausibility: Relation Set Completion in Knowledge Graphs


45. The CRISTAL Method: Neurosymbolic analysis from AI-synthesized world models


46. CLQT: A Closed-Loop, Cost-Aware, Strategy-Consistent Benchmark for Diagnostic Evaluation of LLM Portfolio-Management Agents


47. Rethinking Generative Reconstruction Attacks against Graph Neural Network Models


48. DEEPMED Search: An Open-Source Agentic Platform for Medical Deep Research with Introspective Verification


49. DeepTrans Studio: Turning Expert Interventions into Shared Team Knowledge in Agentic Translation Workflows


50. GUICrafter: Weakly-Supervised GUI Agent Leveraging Massive Unannotated Screenshots


51. Toward Secure and Reliable PDDL Formalization of Large Language Models with Planner-in-the-Loop Feedback


52. Sample-Efficient Learning of Probabilistic Causes for Reachability in Markov Decision Processes with Probabilistic Guarantees


53. Diversity is the Strength of the AI Crowd


54. Safety from Honesty in a Disinterested AI Predictor


55. Budgeted Act-or-Defer Multi-Agent LLM Deliberation with Local Reliability Bounds


56. SFBench: The SciFy Scientific Feasibility Benchmark


57. SCARCE: Scalable Cascade Analysis for Rare-event Characterisation via Embeddings


58. Learned Coordination Conventions in Cooperative MARL: Measuring the Translation Gap Between Theory-Informed Roles and Learned Routing


59. OSWorld2.0: Benchmarking Computer Use Agents on Long-Horizon Real-World Tasks


60. UCOB: Learning to Utilize and Evolve Agentic Skills via Credit-Aware On-Policy Bidirectional Self-Distillation


61. Cognitive World Models for Process-Level Social Influence Evaluation


62. Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving


63. Agent-Computer Observation Interfaces Enable Dynamic Computer Use


64. How Much Due Diligence Before You Bid? Learning in Intractable Takeover Auctions


65. FADE: Mitigating Hallucinations by Reducing Language-Prior Dominance in Large Vision-Language Models


66. Mixture of Debaters: Learn to Debate at Architectural Level in Multi-Agent Reasoning


67. LLM-Guided Planning for Multi-hop Reasoning over Multimodal Nuclear Regulatory Documents


68. Diagnosing and Repairing Factual Errors in RAG under Budget Constraints


69. When LLMs Develop Languages: Symbolic Communication for Efficient Multi-Agent Reasoning


70. PHF: Privileged Hidden Flow for On-Policy Self-Distillation


71. Hierarchical Experimentalist Agents


72. Process Advantage Signal Shaping: A Paradigm-Agnostic Middleware for Process-Supervised RL in LLM Reasoners


73. The Complexity Ceiling Benchmark: A Multi-Domain Evaluation of Sequential Reasoning Under Depth Scaling


74. When Summaries Distort Decisions: Information Fidelity in LLM-Compressed Financial Analysis


75. SurgVLA-Bench: Towards Evaluating Vision-Language-Action Models for Laparoscopic Surgical Robotics


76. PolicyGuard: A Dialogue-Grounded Sub-Agent Verifier for Policy Adherence in LLM Agents


77. A Cognition-Emotion-Personality Framework for Modeling Human-Like Awareness and Behavior in Emergency Evacuations


78. AI Trading’s Alpha Singularity: Emergent Market Reasoning through Agent-to-Agent Self-Evolution


79. Evidence-Informed LLM Beliefs for Continual Scientific Discovery


80. Measuring Graph-to-Graph Semantic Similarity in Knowledge Graphs: An Empirical Evaluation of Knowledge Graph Embeddings


81. Selective Memory Retention for Long-Horizon LLM Agents


82. Direct Causation in International Humanitarian Law and the Challenge of AI-Mediated Civilian Cyber Operations


83. Pooled Leaderboards Hide System-Specific Winners: A Reporting-Protocol Audit of Offline Root-Cause Analysis Benchmarks


84. Flow Reasoning Models: Scaling Reasoning Through Iterative Self-Refinement


85. HiComm: Hierarchical Communication for Multi-agent Reinforcement Learning


86. Characterizing Large Language Model Agentic Workflows: A Study on N8n Ecosystem


87. Managing the Human Fallback: Skill Investment Under Improving AI and Worker Mobility


88. Low-cost concept-based localized explanations: How far can we get with training-free approaches?


89. Memory as an Attack Surface in LLM Agents: A Study on Multiple-Choice Question Answering


90. Preventing Error Propagation in Multi-Agent AI through Runtime Monitoring


91. Customized Generative AI Agent for Transportation Engineering Practice: A Development and Continued Pre-training Guideline


92. Expert Evaluation of Clinical AI Tools on Real Point-of-Care Clinical Queries


93. MedEvoEval: Evaluating Continual Evolution of Doctor Agents through Simulated Clinical Episodes


94. Primary ICD Category Prediction using LLM-based Probing


95. HyphaeDB: A Living Knowledge Topology for Agent-First Memory


96. Mechanistic Personality Analysis of LLMs Steering Personality via Latent Feature Interventions


97. Self-Supervised Theorem Discovery in a Formal Axiomatic System


98. Agent Safety Is Action Alignment


99. Agentic Abstention: Do Agents Know When to Stop Instead of Act?


100. ComMem: Complementary Memory Systems for Test-Time Adaptation of Vision-Language Models


101. TrajRS: Towards Certified Robustness in Pedestrian Trajectory Prediction


102. The Two Genie Game: Adoption and Welfare in Audit-Grounded AI Governance


103. BV-Blend: Uncertainty-Weighted Historical Baselines for Stable Critic-Free RL with Verifiable Rewards


104. COMPASS: Grounding Composition-Intent Guidance in Unified Multimodal Models


105. An AI agent for treatment reasoning over a biomedical tool universe


106. Aristotelian Virtue Profiling of LLMs through Ethical Dilemmas


107. Search for Truth from Reasoning: A Dynamic Representation Editing Framework for Steering LLM Trajectories


108. IMCBench: A benchmark for multimodal LLMs in Image-grounded Medical Conversations


109. GPTNT: Benchmarking Real-Time Collaboration Between Multimodal Agents on Keep Talking And Nobody Explodes


110. Data and Evaluation Closed-Loop for Model Capability Enhancement


111. Recursive Self-Evolving Agents via Held-Out Selection


112. VLK: Learning Humanoid Loco-Manipulation from Synthetic Interactions in Reconstructed Scenes


113. LeVo 2: Stable and Melodious Song Generation via Hierarchical Representation Modeling and Progressive Post-Training


114. GROW$^2$: Grounding Which and Where for Robot Tool Use


115. Pessimism’s Paradox: Conservative Offline Training Amplifies Reward Hacking During Online Adaptation in Reasoning Models


116. Optimization Dynamics Imprint Semantic Specificity in Contrastive Embedding Norms


117. C$^{2}$R: Cross-sample Consistency Regularization Mitigates Feature Splitting and Absorption in Sparse Autoencoders


118. MESA: Prioritizing Vulnerable Communication Channels for Securing Multi-Agent Systems


119. Words Speak Louder Than Code: Investigating Cognitive Heuristics in LLM-Based Code Vulnerability Detection


120. Beyond 2D Matching: A Unified Single-Stage Framework for Geometry-Aware Cross-View Object Geo-Localization


121. A Multi-task Mixture of Experts Framework for Malware Classification, Packing Detection, and Family Attribution


122. TraceLab: Characterizing Coding Agent Workloads for LLM Serving


123. To Tab or Not to Tab: Measuring Critical Engagement in AI Code Completion Tools Using Behavioral Signals and Attention Checks


124. TRACE: Temporal Relationship-Aware Conversational Entrainment Detection in Dyadic Speech


125. Learning from Mistakes: Rollout-Retrieval Lifelong Policy Learning for Autonomous Driving


126. Informational Frustration in Neural Manifolds: Shannon Bottlenecks and the Limits of Learnability


127. On the Faithfulness of Post-Hoc Concept Bottleneck Models


128. McMg: A Learned Phase-Space Multi-channel Multigrid Preconditioner for Helmholtz Equation


129. SIMAX: A Scalable and Interpretable Framework for Multi-Fidelity and Annotated Clinician-Patient Dialogue Simulation


130. Situation Perception: A Necessary Primitive to Artificial Superintelligence


131. COHORT: Collaborative Orchestration for Hardening via Offensive Replay on Emulated Topologies


132. Field Order Should Not Matter: Permutation-Invariant Embedding Model Fine-Tuning for Structured Metadata Retrieval


133. Collective cooperation without individual fidelity in LLM agents


134. Translating Natural Language to Strategic Temporal Specifications via LLMs


135. Transformer Architectures as Complete Bayes Processes: A Formal Proof in the Measure-Theoretic Kernel Framework


136. Beyond Point Estimates for Glaucoma Visual Field Forecasting with Diffusion Models


137. Can LLMs Rank? A Tale of Triads and Triage


138. Beyond IID: How General Are Tabular Foundation Models, Really?


139. Model Predictive Current Control with Harmonic Correction for Single-Phase AC-DC EV Charging


140. A Stochastic–Geometric Theory of Scaling Laws in Grokking


141. Set-Inclusive Uncertainty Modeling for Robust Brain Tumor Segmentation


142. ReactiveBFM: Reactive Closed-Loop Motion Planning Towards Universal Humanoid Whole-Body Control


143. Residual-Guided Expert Specialization for Incomplete Multimodal Learning


144. FFAvatar: Feed-Forward 4D Head Avatar Reconstruction from Sparse Portrait Images


145. DRIFT: Difficulty Routing Self-DIstillation with Rhythm-Gated Exploration and Success BuFfer Training


146. Early Cue Precision Shapes Visual Shortcut Learning in Controlled Cue-Manipulation Benchmarks


147. MCP Server Architecture Patterns for LLM-Integrated Applications


148. Always-OnAgents:A Survey of Persistent Memory, State, and Governance in LLMAgents


149. Research Entity Extraction and Topic Detection from UKRI Grant Proposals


150. Towards Continual Motion-Language Agents: LoRA Variants for Incremental Motion Understanding and Generation


151. Defending Against Harmful Supervision Hidden in Benign Samples


152. KnowsTFM: Knowledge-Informed Fine-Tuning of Small Tabular Foundation Models


153. Curvature-Guided Sheaf Diffusion for Unsupervised Community Detection on Heterophilic Graphs


154. Efficient RGB-T Object Detection via Sparse Cross-Modality Fusion


155. A Multi Center Breast FNAC Whole-Slide Cytology Dataset for AI-Assisted Patch-Wise Classification Using C1 to C5 Reporting Categories


156. Forewarned is Forearmed: When Non-Sequential Embedding Turns Into an Anomaly Detector


157. Few-Shot Domain Incremental Learning via Continual Vision-Language Consolidation


158. Beyond Drug Discovery: The Nanotechnology Molecular Optimization (NMO) Benchmark


159. Federated Learning with Energy-Based Structured Probabilistic Inference


160. Physically-Constrained Harmonic Separation for Robust Heart and Respiratory Rate Estimation from Wrist Photoplethysmography


161. Estimating Grammatical Gender Directions in Contextual Embeddings under Controlled and Natural Contexts


162. Query-Aware Spreading Activation for Multi-Hop Retrieval over Knowledge Graphs


163. Hyper-Network Neural Functional Maps for Unsupervised Robust 3D Shape Matching


164. Gravitational Duals from Equations of State II: Large Hierarchies and False Vacua


165. SA-VLA: State-aware tokenizer for improving Vision-Language-Action Models’ performance


166. Automating the Design of Embodied AgentArchitectures


167. Online Data Selection for Instruction Tuning via Gaussian Processes


168. Neural Subspace Reallocation: Continual Learning as Retrieval-Based Subspace Memory Management


169. Little Brains, Big Feats: Exploring Compact Language Models


170. MuseBench: Benchmarking Intent-Level Audiovisual Arts Understanding in MLLMs


171. IBRSteG: Learning a Generalizable Steganography Framework for 3D Gaussian Splatting


172. T3R: Deeper Test-Time Adaptation for Graph Neural Networks via Gradient Rotation


173. Stabilizing Extrapolation in Looped Transformers via Learned Stochastic Stopping


174. RiverONE: Generating Knowledge-Intensive VLM by Simulated Quantum Machines


175. DuoMem: Towards Capable On-Device Memory Agents via Dual-Space Distillation


176. SWE-Together: Evaluating Coding Agents in Interactive User Sessions


177. SpreadsheetBench 2: Evaluating Agents on End-to-End Business Spreadsheet Workflows


178. Exploiting Local Flatness for Efficient Out-of-Distribution Detection


179. Data-Efficient Multimodal Alignment for Histopathology-based Molecular Prediction


180. Latent-CURE for Breast Cancer Diagnosis


181. EVAF: A Test-Retest Protocol for Selective Parametric Consolidation


182. Pondering the Way: Spatial-perceiving World Action Model for Embodied Navigation


183. CW-B: Class Weighted Boosting Framework for Imbalance Resilient Multi Class Cardiac Phenotyping


184. Semi-Supervised Sound Event Detection with Conditional Mixup and Embedding-Level Contrastive Loss


185. LLM-based Multimodal Personality Recognition via Facial Action Unit-Text Semantic Fusion


186. Critical Interval MSE: Toward Reliable Offline Validation for Robot Manipulation Policies


187. Child-Centric Voice Anonymization in Single and Multi-Speaker Speech via Domain-Adapted SSL Models


188. SABER-Math: Automated Benchmark for Information Retrieval Evaluation in Mathematics


189. Trust Your Instincts: Confidence-Driven Test-Time RL for Vision-Language-Action Models


190. LWDrive: Layer-Wise World-Model-Guided Vision-Language Model Planning for Autonomous Driving


191. Clinical Reasoning Graphs: Structured Evaluation of LLM Diagnostic Reasoning Reveals Competence Without Consistency


192. ARKD: Adaptive Reinforcement Learning-Guided Bidirectional KL Divergence Distillation for Text Generation


193. RoAd-RL: A Unified Library and Benchmark for Robust Adversarial Reinforcement Learning


194. SUMO: Segment and Track Any Motion with Nonlinear State Space Models


195. Exploring Motivations for Algorithm Mention in the Domain of Natural Language Processing: A Deep Learning Approach


196. MATCH: Modulating Attention via In-Context Retrieval for Long-Context Transformers


197. Neural Procedural Memory: Empowering LLM Agents with Implicit Activation Steering


198. Experience Graphs: The Data Foundation for Self-Improving Agents


199. Dual-Flow Reinforcement Learning with State-Aware Exploration


200. How Far Can You Get Without a GPU? A Systematic Benchmark of Lightweight Hallucination Detection Across Question Answering, Dialogue, and Summarisation


201. Making Multimodal LLMs Reliable Chart Data Extractors: A Benchmark and Training Framework


202. Accelerating Q-learning through Efficient Value-Sharing across Actions


203. Multi-Level Distributional Entropy for Explainable Network Intrusion Detection


204. What Drives the Inlier-Memorization Effect? A Theory of Outlier Detection via Early Training Dynamics


205. HERO: Improving the Reliability and Sensitivity of Generative Model Evaluation Using Historical Data


206. FalconTrack: Photorealistic Auto-Labeled Perception and Physics-Aware Vision-Based Aerial Tracking


207. Mandol: An Agglomerative Agent Memory System for Long-Term Conversations


208. Towards Generalizable and Evidential Nuclear Magnetic Resonance-Based Molecular Structure Elucidation via Large Language Model Agent


209. TopoAgent: An Agentic Framework for Automated Topology Learning in Medical Imaging


210. PS-PPO: Prefix-Sampling PPO for Critic-Free RLHF


211. From Trait to Behavior: A Cognitive-Affective Personality System (CAPS) Perspective on Multi-Homing Intention in AIGC Platforms


212. Redefining Maritime Anomaly Detection via Equation-Grounded Synthetic Anomalies



214. Optimizing Expert-Designed Crystal Graph Networks for Band-Gap Prediction with an Autonomous LLM Research Loop


215. SEVA: Self-Evolving Verification Agent with Process Reward for Fact Attribution


216. ARMOR: Adaptive Retriever Optimization for Low-Resource Telecom Question Answering


217. Early Warning Signals for OpenVLA Failure under Visual Distribution Shift


218. A Machine-Verified Proof of a Quantum-Optimization Conjecture


219. Unlocking the Visual Record of Materials Science: A Large-Scale Multimodal Dataset from Scientific Literature


220. Hybrid Retriever Evolution for Multimodal Document Reasoning Agents


221. Fuzzing Large Language Models to Elicit Hidden Behaviours


222. Fast Wireless Foundation Models with Early-Exits


223. Two-Stage Prompt Optimization for Few-Shot Relation Extraction: From Reasoning-Guided Search to Gradient-Guided Refinement


224. Do We Still Need Fine Tuning? Turkish Sentiment Analysis in the Era of Large Language Model


225. Does Role Specialization Matter for Explanation Faithfulness in Mixture-of-Experts?


226. Mechanistically Eliciting Latent Behaviors in Language Models


227. Langshaw: Declarative Interaction Protocols Based on Sayso and Conflict


228. One Scene, Two Depths: Probing Geometric Ambiguity in Monocular Foundation Models


229. How AI settled the complexity of the oldest SGD algorithm


230. SonoCLIP: Mask-Guided Region-Aware Vision-Language Pretraining for Fetal Ultrasound Analysis



232. The Joint Effect of Quantization and Sampling Temperature on LLM Safety Alignment: A Factorial Analysis


233. ScAle: Attention Head Scaling as a Minimal Adapter for Spatial Reasoning in Vision Language Models


234. ReMAP-PET: Beyond Visual Understanding – Learning Region-Guided Metabolic Alignment Semantics from Brain PET


235. TF-MoE: Time-Frequency Mixture-of-Experts for Efficient Speech Separation


236. Coverage-Driven KV Cache Eviction for Efficient and Improved Inference of LLM


237. VISTA-DZ: Visual Semantic Trajectory Adaptation for Personalized Dilemma Zone Prediction


238. Proteus: Automated Adversarial Robustness Testing for Audio Deepfake Detectors


239. Em-ergence of the em-dash: a population-level rise in em-dash frequency in medRxiv preprints at the dawn of the large-language-model era


240. RESOURCE2SKILL: Distilling Executable Agent Skills from Human-Created Multimodal Resources


241. SemJoin: Semantic Join Optimization


242. MotionAtlas: Detailed Region Captioning for Motion-Centric Videos


243. SAKE: Software Architectural Knowledge Evaluation Benchmark for Large Language Models


244. The Verbose Context Problem in Medical Records


245. Reported Confidence in LLMs Tracks Commitment More Than Correctness


246. To Reason or to Fabricate: Reasoning Without Shortcuts via Hint-Anchored Pairwise Aggregation


247. CRAFT: Counterfactual Credit Assignment from Free Sibling Rollouts for Self-Distilled Agentic Reinforcement Learning


248. A Posteriori Error Analysis for Decoupled Neural Approximations of Fully Coupled FBSDEs with Control Mismatch


249. Rank-Aware Hyperbolic Alignment for Vision-Language Dataset Distillation


250. Interpretable Inverse Design of Metal-Organic Frameworks with Large Language Model Agents


251. Resonant Brane Splatting for Arbitrary-Scale Super-Resolution


252. Bridging VideoQA and Video-Guided Agentic Tasks via Generalized Keyframe Extraction


253. Closing the Activation-Cone Blind Spot: Response-Time Probing and Unified Defense


254. LLMography: Transforming Human-AI Conversations into Traceability, Oversight, and Auditability Indicators


255. Can Machines Really See Objects in Images? A Study Based on Syntactic Distance and Visual Self-Referential Instances


256. LC-ICL: Label-Guided Contrastive In-Context Learning for Robust Information Extraction


257. Self-Organized Conformal Prediction: Reducing Regional Coverage Gaps with Unsupervised Group Discovery


258. Learning to Adaptively Allocate Gaussians for Arbitrary-Scale Image Super-Resolution


259. DR-GS: Physically-Based Deformable and Relightable 2D Gaussians


260. Solver-Verified Formulation Generation and Selection for Multi-Warehouse Inventory Allocation Using Large Language Models


261. Dynamic Parsing and Updating Natural Language Specification using VLMs for Robust Vision-Language Tracking


262. Fast Enough to Act: Spatio-Temporal Visual Token Merging for Low-Latency Robotic VLMs and VLAs


263. Adaptive Financial Transformer with Regime-Gated Attention for Stock Return Prediction


264. AMR: Adaptive Modality Routing for Multimodal Polyglot Speaker Identification


265. Covering the Unseen: Information Demand Coverage Optimization for Retrieval-Augmented Generation


266. Deterministic Decisions for High-Stakes AI. A Zero-Egress Pipeline with the Deployability of RAG and the Accuracy of Machine Learning


267. Manufactured Confidence: How Memory Consolidation Turns Hearsay into Confident Facts


268. A Hybrid Framework for Song Lyric Annotation Based on Human-LLM Alignment


269. Confidence-feedback-weighted graph matching network: online-offline laser-induced damage site matching under complex interference


270. MoPe: Motion Permanence for Robust Monocular Gaussian Mapping in Dynamic Environments


271. AnyBody: Free-Form Whole-Body Humanoid Control from Arbitrary Keypoint Guidance


272. Behavior Uncloning: Distilling Mode Redirection into Policy Weights without Inference-Time Steering


273. A Multi-Dataset Benchmark for Evaluating LLM Agents in Microservice Failure Diagnosis


274. Anomaly Factory 3D: A Modular Framework for Diverse Pseudo-Anomaly Synthesis in Unsupervised 3D Anomaly Detection


275. Symbolic Mechanistic Data Attribution: Tracing Training Influence to Learned Behavioral Policies


276. Projected Exploitability Descent for Nash Equilibrium Computation in Multiplayer Imperfect-Information Games


277. Invariant Reasoning Directions in Latent Trajectories of Language Models


278. On the Nonlinearity of Learning Rate Scaling for LLM Training


279. GPC: Large-Scale Generative Pretraining for Transferable Motor Control


280. CMTFormer: Marrying Transformer with Hierarchical Information Interaction for RGB-Event Object Detection


281. How Anthropomorphic Language Impacts Public Perceptions of AI


282. Knowing in Advance When an Evolutionary Outer Loop Will Not Help: A Pre-Registered Cheap-Baseline Screening Rule


283. When Stopping Fails: Rethinking Minimal Risk Conditions through Human-Interactive Autonomous Driving for Safe Transportation Systems


284. LLM Semantic Signaling Game and Mechanism Design: Systematic Blindness, Awareness Shaping, and Mindset Dynamics


285. A Deep Multiscale Neural Network for Accurate Neurological Disorder Detection from MRI Scans and Real-Time Web Deployment


286. BTI-Net: Bidirectional Decoder-Level Task Interaction via Uncertainty-Aware Gating for Multi-Task Medical Image Analysis


287. Unified Complex-valued Neural Network: A Magnitude-Phase Computational Model for Event-Driven Neuromorphic Learning


288. Priced Motion Through Optimal Faces: A Normal-Fan Geometry for Non-Stationary Adversarial MDPs


289. Statistically Indistinguishable, Operationally Distinct: A Formal Barrier for Tabular Foundation Models


290. AB-RAG: Adaptive Budgeted Retrieval-Augmented Generation for Reliable Question Answering


291. Diff-Based Code Corruption using LLMs for Large-Scale Bugfix Benchmarking


292. From Tool Connection to Execution Control: Benchmarking Security Invariants in MCP-Style Agent Runtimes


293. A Comparative Study on Affective Cues in Text Embeddings Across Psychological Emotion Theories


294. Fairness Attacks on Recommender Systems


295. Flow Matching in Feature Space for Stochastic World Modeling


296. Metric Aggregation Divergence: A Hidden Validity Threat in Agent-Based Policy Optimization and a Contractual Remedy


297. The strength of clinical evidence is recoverable from language model representations but not from their stated grades


298. How to Leverage Synthetic Speech for LLM-Based ASR Systems?


299. Efficient Spatio-Temporal Grounding with Multimodal Large Models via Second-Level Tracking and RL Verification


300. Semantic-Aware, Physics-Informed, Geometry-Grounded Weather Video Synthesis


301. BERTomelo: Your Portuguese Encoder Best Friend


302. Reward-Free Code Alignment from Pretrained or Fine-Tuned LLM: Unpacking the Trade-offs for Code Generation


303. Arbitrary Reduction of Validation Error for AI Decision Tests using Homomorphic AI and Repetition Codes


304. Fine-Tuning General-Purpose Large Language Models for Agricultural Applications:A Reproducible Framework and Evaluation Protocol Based on Qwen3-8B


305. Compositional Dynamics in Learning and Mechanics


306. Evidence-Based Text-Conditioned 3D CT Synthesis for Ovarian Cancer


307. RGLD: Randomized Global-Local Density Estimation for Tabular Anomaly Detection


308. Modification-Considering Value Learning for Reward Hacking Mitigation in RL


309. Clustering Unsupervised Representations as Defense against Poisoning Attacks on Speech Commands Classification System


310. Machine-learnable Sets


311. DLR: Zero-Inference-Cost Latent Residuals for Low-Rank Pre-Training


312. Multi-Agent Routing as Set-Valued Prediction: A WildChat Benchmark and Cost-Aware Evaluation


313. Latent Bridges for Multi-Table Question Answering


314. A Task-Driven and Quality-Assured Agent Framework for SAR Data Generation


315. Exploring the Value of Diverse LLM Explanations in Introductory Programming


316. An Integrated Machine Learning and Hierarchical Variance Decomposition Pipeline for Student Performance Prediction and Metacognitive Calibration on Multi-Signal Telemetry


317. Defeat Devices in AI Systems


318. Building AI-Ready Data Systems for Space Life Sciences, Aerospace Medicine, and Deep Space Exploration


319. Perspectives on Latent Factor Indeterminacy and its Implications for Data Representation


320. The Heterogeneous Safety Impacts of Benign Multilingual Fine-Tuning


321. LAMP: Lean-based Agentic framework with MCP and Proof Repair


322. Fisher-Routed Mixture of Experts for Federated Class-Incremental Learning


323. HARD-KV: Head-Adaptive Regularization for Decoding-time KV Compression


324. Exit-and-Join Dynamics and Equilibrium in Continuum Cooperative Games


325. Categorizing Mathematical Concepts with LLM Voting Ensembles in Mathswitch


326. Human2Any: Human-to-Robot Transfer via Constraint-Aware Compositional Planning


327. The registrar’s function in a hybrid society. AI value chain,smart data and the concept of property


328. BREIT: A Framework for Brain Stroke Reconstruction using Multi-Frequency 3D EIT


329. Brownian Bridge Diffusion-Based Joint Channel Estimation and Data Detection for Jamming-Resilient Receivers


330. Majority Vote Silences Minority Values: Annotator Disagreement at the Hate/Offensive Boundary in HateXplain


331. X-Mind: Efficient Visual Chain-of-Thought via Predictive World Model for End-to-End Driving


332. Four Types of LLM Reliance and Their Predictors Among Undergraduate Writers: A Mixed-Methods Study at a Minority-Serving R1 University


333. 5ting at SemEval-2026 Task 8: Strong End-to-End Multi-Turn RAG via LLM-Based Reranking and Faithfulness Control


334. CCRC: A Change-Aware Captioning and Reasoning Chain for Image Change Captioning and Segmentation


335. SEATauBench: Adapting Tool-Agent-User Evaluation Into Low-Resource Southeast Asian Languages


336. Capability Gates Are Not Authorization: Confused-Deputy Failures in LLM Agent Frameworks


337. Predicting Metastatic Risk from Primary Tissue Architecture via Distance-Aware Spatial Modeling


338. Constrained Tabular Diffusion for Finance


339. MACROCAST: A Vintage-Consistent Time Series Foundation Model for Real-Time Macroeconomic Forecasting


340. Why Trust Your Agent? Empirical Security Gains from TRiSM-Guided Agentic Workflows in Healthcare


341. Closed-Form Steepest Descent Direction toward Flat Minima: Reducing Upper Bounds on the Loss Hessian Eigenspectrum in Neural Networks


342. When More Sampling Hurts: The Modal Ceiling and Correlation Ceiling of Test-Time Scaling


343. SemDynReg: Semantics-Guided Deformation Regularization for Dynamic 3D Gaussian Splatting


344. FedLAS: Feature-Modulated Bidirectional Label Smoothing for Neural Network Calibration


345. RIPA: Sensory-Vector Prompt Injection Attacks on LLM-Controlled ROS 2 Robots


346. Analysis of Parameter Settings for the Bat Algorithm Using Variance Evolution


347. The Undecidability of Artificial General Intelligence (AGI) Alignment


348. What LLMs explain is not what they believe: Evaluating explanation sufficiency under models’ own input beliefs


349. Fast and Accurate Outlier-Aware LiDAR Super-Resolution for SLAM Applications


350. Database Context Compression for Text-to-SQL on Real-World Large Databases


351. Neuromorphic Energy-Aware Learning for Adaptive Deep Brain Stimulation


352. Animation2Code: Evaluating Temporal Visual Reasoning in Video-to-Code Generation


353. Correct codes for the wrong reasons? validating LLMs as measurement instruments for theoretical constructs


354. Geometric Measurements of the Axiom of Choice in Neural Proof Embeddings


355. Digitizing Coaching Intelligence: An Agentic Framework for Holistic Athlete Profiling using VLM and RAG


356. KernelSight-LM: A Kernel-Level LLM Inference Simulator


357. MammoFlow: Multiview Mammogram Synthesis with Anatomically Consistent Flow Matching


358. CMSL: Constructive Multi-Sequence Learning for Recommendation Systems


359. The Speedup Paradox: Rethinking Inference Speed-Quality Trade-off in Embodied Tasks


360. A Gravitational Interpretation of Fine-Tuning Reversion


361. HDDPM: Heteroscedastic Denoising Diffusion Probabilistic Model for Quantitative Low-Count Brain PET Recovery


362. Generative AI Literacy Training Improves Intelligence Analysts’ Discrimination of Real and AI-Generated Images


363. TUA-Bench: A Benchmark for General-Purpose Terminal-Use Agents


364. Decomposing Memorization Reduction in Privacy-Preserving Fine-Tuning of SLMs for CSIRTs


365. Improvement of Robot’s Simultaneous Localization and Mapping Using an Effective Transformation to Achieve Linear Model


366. An Agentic AI Pipeline for Appliance-Level Energy Anomaly Detection and LLM-Driven Recommendations


367. SVC-Probe: A Framework for Evaluating Perturbation Generalization in Spatial Foundation-Model Embeddings


368. Counterfactual Residual Data Augmentation for Regression


369. Is Lying an Emergent Behaviour in LLMs? Evidence from Gaslighting AI agents in a Sustainability Game


370. Event-Conditioned Diagnostics of Kinematic, Contact, and Object-Permanence Fields in Passive Object-State World Models


371. LLM agents security duality: a comprehensive survey of self-security and empowered cybersecurity


372. SemFlowRAG: Directed Semantic Flow from Abstraction to Evidence for Complex Reasoning


373. Domain-Informed Multi-View Self-Distillation for Astronomical Light-Curve Representation Learning with JEPA


374. LoRA-Tuned Large Language Models for Dementia Detection via Multi-View Speech-Derived Features


375. S-GAI: Spectral Geometry-Aware Initialization for Sigmoidal MLPs – From Dataset Geometry to Network Weights


376. Learning to Distributedly Estimate under Partially Known Dynamics: A Covariance-Agnostic Neural Kalman Consensus Filter


377. PLAA: Packet-level Adversarial Attacks in Network Traffic Detection


378. When AI Reviews Its Own Code: Recursive Self-Training Collapse in Code LLMs


379. Dockerless: Environment-Free Program Verifier for Coding Agents


380. SWE-MeM: Learning Adaptive Memory Management for Long-Horizon Coding Agents


381. Spectral Perturbation of the Empirical Fisher Information Matrix under Weight Quantization


382. Building to the Test: Coding Agents Deliver What You Check, Not What You Requested


383. Tool Use Enables Undetectable Steganography in Multi-Agent LLM Systems


384. JuZhou 1.0 Technical Report: The First Edge-Native Text-to-Image Foundation Model Trained Entirely on China-Developed AI Accelerators


385. MedDiffuseMix: Preserving Diagnostic Evidence with Saliency-Aware Diffusion Medical Image Data Augmentatio


386. AEGIS: A Semantic GAN and Evidential Learning Frameworkfor Robust Adversarial Detection in Vision Sensors


387. On the Necessity of a Liquid Substrate for Mesh Intelligence


388. RSGPNet: Geometric Prompting for Remote Sensing Open-Vocabulary Semantic Segmentation


389. Evidence-Driven LLM Agent for C-to-Synthesizable-C Conversion and Verification


390. Financing Artificial Intelligence Infrastructure: Mapping AI Infrastructure Investment and Compute Governance Across Africa


391. Reinforcement Learning for Software Vulnerability Analysis: A Systematic Review with Emphasis on C/C++ Source Code and Static Analysis


392. CLOSER-VLN: Closed-Loop Self-Verified Retrieval-Augmented Reasoning for Aerial Vision-Language Navigation


393. RADIANT-PET: Reasoning-Augmented PET/CT Lesion Segmentation with Large Language Models and Reinforcement Learning


394. Few-class Fidelity: Evaluating Explanations of Real-conditions CNN classifiers with Optimized Perturbations


395. Automated Quality Assessment of Geospatial Vector Data: A GeoAI Approach using Spatial Representation Learning


396. Schema-First Retrieval: Embedding Catalogs for Natural Language Analytics


397. Data Provenance for Image Auto-Regressive Generation


398. RoboGaze: Evaluating Robot World Models via Structured Vision-Language Analysis


399. A Query-Driven Communication-Efficient Digital Twins Design for Autonomous Driving


400. Evolutional Math: Cross-Validated Island-Model Genetic Programming for Interpretable Symbolic Regression on Small, Wide Datasets


401. Distilling a Modular Reservoir Through a Genomic Bottleneck


402. LEDGER: Scaling Agentic Document Editing with Dependency-aware Graph Retrieval


403. Memory-Augmented LSTM Autoencoder for Unsupervised Activity Recognition with IMU Sensor Fusion


404. When Does Overlap Help? OSU-Mem and a Cell-Conditional Analysis of Trajectory Memory for LLM Agents


405. Model Merging to Evolution: Parameter Space Exploration for Expert Models


406. Conversational Query Engine for Mixed-Modality Heterogeneous Enterprise Data Sources


407. Multimodal and Multiscale Spatial-Temporal Semantic Search and Recommendation with AI Foundation Models


408. Beyond the Reranker: Do RAG Retrieval Enhancements Help Once a Strong Reranker Is Present?


409. CAMI: Cost-Aware Agent-Guided Multi-Indexing for Semantic Retrieval


410. meta-pipe: An LLM-agent pipeline for end-to-end automated systematic review and meta-analysis


411. LUMEN: Cost-Transparent Multi-Agent Pipeline for Automated Systematic Review and Meta-Analysis


412. ConCise: Training-Free Conclusion-Chain State Compression for Cost-Efficient Multi-Step RAG Services


413. Carolina Guide: A Multi-Agent RAG System with Institutional Guardrails for Academic Policy Assistance


414. How Do LLMs Cite? A Mechanistic Interpretation of Attribution in Retrieval-Augmented Generation


415. ReasonRec: A Reasoning-Augmented Multimodal Agent for Unified Recommendation


416. SafeGEO: Understanding Generative Engine Optimization Risks in Recommendation Agents


417. From Regulatory Approvals to Patents: Cross-Domain Linking for Cardiovascular Device Traceability


418. HMARS: A Hierarchical Multi-Agent Memory System for Long-Context Reasoning


419. Agentic Safety is an Epistemic Property, Not a Behavioral One


420. Auditing LLM-Governed Social Robots with Culture-Specific Moral Gradients


421. PIXELRAG: Web Screenshots Beat Text for Retrieval-Augmented Generation


422. The Crowded Embedding Space: A Mean-Field Mechanism for Emergent Marginalization in Retrieval-Augmented Agents


423. Operating Regimes of Decentralized Learning Under Mobility and Bandwidth Constraints


424. Multi-Agent DRL for QoS and Energy Optimization in RIS-Enabled Open-RAN Industrial 6G TN/NTN Networks


425. A Systems-Level Analysis of Sensitivity, Robustness, and Stability in Retrieval-Augmented Generation


426. HyBIRD: Hyperbolic Bridge Retrieval and Diagnosis for Methodology Inspiration Retrieval


427. LLM-Ideoplasticity: Measuring Ideological Plasticity in the Political Behavior of LLMs as a Context-Conditioned Distribution


428. Ground Truths in Suicide Research: The Current State of AI-Based Suicide Detection in Social Media


429. Insidious by Design: Implications of Large Language Model algorithmic bias for the Global South


430. When Medical Safety Alignment Fails: A Benchmark for Evaluating LLMs on High-Risk Medical Queries


431. “AI Watermarking”: Bridging Policy Discourse and Technical Capabilities


432. High-Dimensional Concentration and Retrieval Instability in Embedding Spaces: Implications for Retrieval-Augmented Generation


433. $M^3 QuestionIng$: Multi-modal Multi-span Medical Question Answering


434. The Interference Gap: Comparing Retrieval Bounds in Human Memory and RAG Systems


435. ADEPT: An Entropy-Driven Dual-Strategy Agent for Interactive Video Retrieval


436. It Lied to a Doctor to Buy Poison Ingredients: Quantifying Real-World Misuse of Phone-use Agents


437. Tool-Augmented Spatiotemporal Reasoning for Streamlining Video Question Answering Task