전체 AI 논문 - 2026-08-04

1. AtumAI: A Principled Framework for Agentic Generation of Datacenter Control-Plane Policies


2. A Taxonomy of Cognitive Capability Gaps in Generative and Agentic AI


3. Magnet: Detecting Cross-Session AI Misuse Through Capability Accumulation


4. Optimizing Minimax Regret in Uncertain MDPs with Small Sets of Policies


5. Abduction Without a Body? Representational Grounding and the Abduction Loop for Scientific Hypothesis Generation


6. CMuon: Accelerating and Stabilizing Diffusion Transformer Training via Chunked Momentum Orthogonalization


7. Long-term Measurements: Towards a Longitudinal Understanding of Human-AI Interactions


8. Real-Time Detection and Repair of LLM Agent Failures


9. Infinite Trace Objectives with Finite Trace Techniques: Translating LTL to LTLf+


10. ParEvalLayer: When Partial LLM-Agent Evaluations Support a Decision


11. Right Answer, Wrong Method: Shortcut Hacking Misleads the Evaluation of LLM Reasoning on Frontier Science Benchmarks


12. Agentic Commerce World: An Auditable and Verifiable Environment for Vibe Commerce


13. xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding


14. MonitrLLM: A Community-Centered Evaluation Infrastructure for Large Language Models


15. Cooperative Coevolution for Resource-Constrained Agentic LLM Post-Training


16. Chess on Ice: Curling Tactical Decision-Making via Backward Induction and Deep Reinforcement Learning


17. Faster-WAM: Do World Action Models Need Deep Action Modules?


18. SkillTrace: Traversing a Query-Skill Graph for Composable LLM Agents


19. KC-Agent: A Dual-Process Cognitive Architecture for Efficient ML Model Improvement


20. Mamba with Hierarchical Memory: Solving Representation Bottleneck in Long Sequence Modeling


21. Hard Constraints, Smooth Gradients: Learning Feasible Inventory Policies via Differentiable Projection


22. Trajectories That Segment Themselves: Agent-Declared Boundaries as a Training Unit


23. MechGeo: Autoformalizing and Proving Euclidean Geometry in Lean 4


24. Shared Prefixes, Better Credit: Adaptive Routing for Multi-Agent Reasoning


25. SKT: Skill-Use Training at Scale via Verified Synthetic Data Generation


26. Harness-R1: Learning to Edit Executable Runtime Harnesses from Agent Failure Trajectories


27. Self-Certification of Representation Adequacy: Sequential Certification at Minimum Task Loss


28. Homebot: A Personal AI Agent for Conversational Home Assistance and Automation


29. Trustworthy AI in Digital Health: A Comprehensive Review of Robustness and Explainability


30. PosterMELD: Multi-Agent Paper-to-Poster Generation for Controllable Design Diversity with Editable Print-Ready Outputs


31. MEGRAG: Multi-Granular Evidence Graphs for Answer-Aware Multi-Hop RAG


32. PAC Approximation and DIRECT Optimization for Parametric Markov Models


33. From Profiling to Synthesis: Benchmarking Implicit Behavioral Alignment in Personalized LLM Agents


34. From Simple QA to Deep Research: A Verifiable Benchmark Constructed through Iterative Task Evolution


35. Auditing Data Provenance in LLM Fine-tuning via Intrinsic Distributional Fingerprints


36. Beyond the Mean: Multi-Moment Policy Optimization for LLM Reasoning


37. Beyond Solution-Centric Search: Adaptive Inquiry and Knowledge Revision for Autonomous ML Engineering


38. MemArbiter: Decision-Time Memory Arbitration for Long-Horizon LLM Agents


39. Fetch-then-Explore: Decoupling Selection from Extraction over a Persistent Workspace for Search Agents


40. Instruction-Conditioned Exploration with Asymmetric Reinforcement Learning and Self-Distillation


41. Cross-Fitted Residual Utility for Primary-Preserving Cognitive Decision Correction in Automatic Modulation Classification


42. HPFA: Hypergraph-Based Paired Failure Attribution for LLM Reasoning


43. EduZone: A Framework for Evaluating LLM Safety for K-12 Students and Teachers


44. Before Reasoning Fails: Pre-Evidence Procedural Failures in Agentic RAG


45. HALT: Verification-Aware Stopping for Retrieval-Augmented Search Agents


46. Evolving in the Agent Jungle via History-Informed Opponent Awareness


47. Long-Horizon Autonomous Architecture Research with a Language-Model Agent: A Behavioural Case Study


48. A Contractualist Argumentation Framework for Moral Decision-Making


49. ProWorld: Progress-Aware Hyperbolic World Models for Long-Horizon Visual Goal Reaching


50. Diagnosing Search Behavior and Failure Modes in Long-Horizon Search Agents


51. CoEvoKG: Co-Evolving Knowledge Graphs with Self-Evolving Search Agents


52. ReasonCast: Towards Explainable Time Series Forecasting with Reasoning


53. Wnuan: Staged Post-Training for Question Answering over Proprietary Enterprise Knowledge


54. EchoChange: A Diffusion Language Model with Dual Pass Remasking for Factual Remote Sensing Disaster Change Captioning


55. Physics-Informed Neural Networks for Complex Eigenfrequency Identification and Mode Structure Reconstruction of the Ground-State ITG Branch


56. Exploring and Bridging Knowledge Holes in Unlearned Multimodal Large Language Models


57. FOCUS: FP4 Optimization via Coupled-Relaxation and Dual-Granularity Scaling


58. PCSD: Persistent Consistency for Self-Distillation in Agentic Reinforcement Learning


59. Rewriting or Reweighting? A Geometric Account in Language Models


60. SearchMaster: Grounded and Regulated Self-Play for Search Agents


61. CockpitHAT: Dependency-Graph-Driven Hierarchical Attribution for Embodied Multi-Agent Cockpits


62. CoNav-UAV: Cooperative Dual-Altitude Aerial Navigation via Stackelberg Learning


63. Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction


64. REFLEX: Rethinking MoE Inference as Refinement-Aware Compute Allocation in Diffusion Language Models


65. FRAMES: Guarded and Dual-Objective Skill Evolution for Agents in Policy-Governed Enterprise Workflows


66. Leveraging AI for fine-grained food safety risk forecasting in sparse data conditions


67. Deferred Exposure of Future Trajectories for Verifiable Reasoning in Autonomous Driving VLMs


68. RL-Lock: Reinforcement Learning for Generating Interlocking Assemblies


69. MemSIF: From Structured Interactions to Dual-Track Fact Memory for LLM Agents


70. CoEvo-Mem: Co-Evolving Retrieval Policy and Memory Bank for LLM Agents


71. DAPD: Dual-Anchored Policy Distillation


72. LaCache: Robust Semantic Caching for LLM Serving


73. Constructing Executable Analytical Knowledge Representations for Meta-Analysis Synthesis Using an Agentic Harness


74. Beyond Single-Use Tokens: Durable Authorization State for Replay-Resistant LLM Agent Actions


75. GABench: A Comprehensive Benchmark for Evaluating LLM Agents on Graph Analysis Tasks


76. When Memory Becomes Authority: Benchmarking Authority Collapse at the Memory Consolidation Boundary


77. TCPO: Turn-Level Credit Policy Optimization


78. Allocation Before Ranking: Decoupled Token Compression for OmniLLMs


79. LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing


80. GISAgentBench: A Practitioner-Sourced Benchmark for Evaluating LLM Agents on GIS Tasks


81. Salami Attack: Stealthy Collusive Memory Poisoning against OpenClaw


82. When Memory Updates but Behavior Does Not: Repairing Implicit Stale Dependencies in Personalized Agent Responses


83. Post-Training on Office Work Improves Software Engineering: A Behavioral Account of Cross-Domain Transfer


84. Latent Thought Credit: Multi-Answer Credit Assignment for Latent Reasoning


85. Is More Privileged Information Better? From Solution Traces to Problem-Solving Structure in Self-Distilled Reasoning



87. Securing Agentic AI: From Per-Action Checks to Trajectory Assurance


88. Emergence Invariance: From Symbolized Thought to Interface Refinement


89. V-Mem: Modality-Routed Retrieval for Long-Term Multimodal Agentic Memory


90. MineGrad: Gradient Inversion Attacks on LoRA Fine-Tuning


91. Sweet Little Lies: Strategic Deception in AI Emotional Support Chatbots


92. Computing with Agentic Oracles


93. Where Reasoning Diverges: Localized Multi-Agent Debate


94. Loud or Silent? A Reusable Framework for Per-Modality Failure Analysis in Multimodal Clinical AI


95. Beyond Routing Saturation: A Long-Horizon Class-Incremental Perspective on Expert Routing in Multimodal Continual Instruction Tuning


96. A New Theory of Value for Post-AGI Economics


97. PolymerGPT: Multi-property Optimization with a Decoder-Based GPT Model for Generative Polymer Design


98. MRAFnd: Multimodal Retrieval-Augmented Framework for Zero-Shot Fake News Detection


99. Scoring Rules! Statistical and Strategic Alignment for Text Evaluation Metrics


100. Reusing Rollouts under Policy Lag: Prefix-Normalized Policy Optimization for LLM Reinforcement Learning


101. No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks


102. KoVRE: Training an Efficient Embedding Model for Korean Visual Document Retrieval


103. CraftAlign: Feature-Grounded Evaluation and Revision Guidance for AI Stories


104. CRAFTS: Collaborative Role-Adaptive Fine-Tuning of LLM Agents for Chemical Process Simulation


105. High-Stakes Decisions with Language Models: Insights from Emergency Triage


106. Agentic Stage-One Stellarator Optimization: Autonomous Multi-Objective Search for Finite-Beta Equilibria


107. 402Pilot: An x402 Decision Layer for Autonomous Agent Micropayments


108. G-ReAct: Graph-Guided Deep Search via Structure-State Co-Evolution


109. Cognitive Demand Steering for Adaptive Meta-Reasoning in Large Language Models


110. Learning What to Remember and What to Internalize in LLM Self-Evolution via Adaptive Memory-Parameter Coordination


111. CT-PrepAgent: Bounded Policy and Controlled Execution for Adaptive CT Data Preparation


112. Perspectives on Tsallis Statistics for Artificial Intelligence


113. Reputation-driven Cooperation in Lattice-based Decentralized Federated Learning through Evolutionary Game Theory


114. Humans Are More Diverse: Frontier LLMs Show Extreme Policies in Idealised AI Development Races


115. Co-evolution of social reward and punishment under institutional interventions


116. The Graph Language: How Knowledge Graphs Speak to Large Language Models


117. PATH-Bench: Path-Dependent Evaluation of Lifelong Agents


118. MA-HEAD-Net: Adaptive Rule-Guided Multi-Agent DRL for AoI Minimization in UAV-Assisted Emergency Networks


119. Fighting Fire with Fire: On the Feasibility of Protecting Exercises Against AI Cheating


120. Inter-Residue Geometry Attention for Antibody-Specific Epitope Prediction


121. Role-Decoupled Attention Residuals: Separating Matching and Content Retrieval Across Depth


122. Control Under Compression: Reliability Frontiers for Tool-Using Agents


123. Don’t Offer What Can’t Be Done: Deterministic Executability Gating for LLM Skill Selection at Scale


124. FactorJEPA: Factorizing Monolithic Futures into Layout-Agent-Interaction Channels for Crowded and Chaotic Global South Urban Worlds


125. Toward Fine-Grained Forgetting:Attribute Unlearning for Multimodal Large Language Models


126. From AI Technical Debt to Agentic Technical Debt: A Systematic Mapping of Root Causes and Manifestations in Agentic AI Systems


127. Judging Is Not Enumerating: Silent Omissions in LLM-Authored Acceptable Sets


128. SCHEDBench: A Benchmark for Evaluating LLM Constraint Faithfulness in Natural-Language Combinatorial Scheduling


129. Auditing Discovery Claims: A Two-Sided Criterion for Agentic Science, with the Negative Side Decidable


130. Passing Coarse Marginal Checks Can Be Cheap: Persona Mixtures and Imprecise Treatment-Response Estimates in an LLM Persona Panel


131. Search-GRT: Guided Retrieval Training of Search Agents to Optimize for Complex Question Answering


132. PROGRESS: Coverage-guided RL to Train Search-augmented LLM Agent


133. TrajWiki: Source-Grounded Memory Trajectories for Long-Horizon Dialogue Agents


134. PMMC: Prospective Multimodal Memory Compilation for Long-Term LVLM Agents


135. Modeling Social Dynamics with an LLM-Enabled Agent Based Network-Dynamic (LAND) Model


136. CADIR: A Cross-Backend Editable Intermediate Representation for Agentic CAD Generation


137. Neuro-Evolved Heuristics for Variable Gapped Common Subsequence Identification


138. Assuming You Knew: Fixing an Epistemic Semantics for Flow Policies Using Agentic AI


139. Similarity Weighted Aggregation with Global Differential Privacy for Federated Brain Lesion Segmentation


140. Isotropy Cliffs: The Geometric Signature of Decision-Making in Large Language Models


141. The Scaling Paradox in Human-AI Collaboration


142. Large language models improve physician accuracy but lead to false reliance


143. AgentSLABench: Evaluating and Benchmarking Agentic Systems Under Resource Constraints


144. Measurement Without Validity: The Compounding Reliability Problem in Agentic AI Evaluation


145. FinDeepIndicator: Benchmarking Deep Research Agents in End-to-End Financial Indicator Construction


146. Behavioral Grammar: Detecting Adaptive Malware via Tiny Language Model Priors and Second-Order Temporal Analysis


147. AI-Based Thesis Assessment: An Empirical Study of Human Evaluation Priorities and Their Impact on Automated Assessment


148. Tracing the Cascade: A Topology-Aware Evaluation Framework for Scientific Agent Hallucinations


149. DGA$_2$D: Directed Graph-Guided Automated Algorithm Design with Large Language Models


150. Evolutionary Curriculum Learning Improves Biological Sequence Modeling


151. When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty


152. Multi-Dimensional Assessment for AI Cognition (MAAC): A Theoretical Framework for Process-Oriented Cognitive Evaluation of Text-Based AI Systems


153. HetGPS: Scalable Graph Multi-Agent Reinforcement Learning with Physics-Anchored Adaptive Safety for EV Charging


154. DASH: Decoupled Adaptive Surrogate - Acquisition Harness for Automated Bayesian Optimization


155. Slides2MindMap: Reconstructing Cognitively Efficient Knowledge Hierarchies from Lecture Slides


156. Escaping Confidence Trap: Evolutionary Decoding for Mathematical Reasoning in Diffusion LLMs


157. Why Does the Future Branch? Identifiable Closure Tests for Stochastic Physical World Models


158. Through the LENS: Local Geometric Decomposition of Vision-Language Model Representations


159. CURE: Local Uncertainty Repair for Block-Parallel Speculative Decoding


160. BayesSeg: A Bayesian Optimization Framework for State Segmentation of Electricity Consumption Time Series


161. TaPR: Test-Aware Policy Refinement for Feedback-Conditioned Code Generation


162. The Bayesian Reflex: A Predictive Coding Engine for Artificial Intelligence


163. F-WANDA: Fisher-Reweighted Post-Training Pruning for Sustainable Deployment of Large Language Models


164. Ekova: A Personality-Support Agent for Self-Discovery Dialogue


165. Diagnose Before You Compress: Prediction-Independent Bottleneck Witness Refinement for LLM Serving Traces


166. TrAC: Trace-Conditioned Answer Consistency for Efficient Uncertainty Quantification in LLMs


167. Mask-Based Priors Are More Persistent than Query-Key Initializations


168. SymboUQ: Symbolic Uncertainty Quantification for Spatial Reasoning in LLMs


169. Where did the ambiguity go? Examining how multimodal models interpret polysemous words


170. Gene Ontology-Guided Hierarchical Spatial Gene Expression Prediction from Histopathology Images


171. Bayesian and Motivated Reasoning in AI Agents


172. RMSWeb: Reflection, Failure-Mode Mining, and Salvage-DS for Web Agent Reinforcement Learning


173. Learning to Coordinate Symbolic Tools: LLM Agents for Verified Sum-of-Squares Certificates


174. Trust and Its Betrayal under Three Representational Strategies


175. CrystalMem: Elastic Memory for Self-Evolving LLM Agents via Knowledge Crystallization


176. WM-Cov: Test Adequacy for Interactive World-Model-Style Autonomous Driving Simulation


177. RF-HOI: Recognize Human-Object Interaction with Radio Frequency Signals


178. Geometric Self-Supervised Pre-training for Neural Combinatorial Optimization


179. More Debate, Same Evidence: Structural Limits of Homogeneous Multi-Agent Groundedness


180. Personalizing Large Language Model Agents with Small Policy Models


181. TRACE-TS: Attribution-Grounded and Traceable Sensor-Language Reasoning for Human Activity Understanding


182. AgentStream: How Well Do Self-Evolving LLM Agents Perform Under Streaming Tasks?


183. Shared Organizational Memory for Enterprise Coding Agents: System Design and Deployment Snapshot


184. Can LLM Agents Price Competitively? A Dynamic Multi-Attribute Auction Benchmark for Agentic Commerce


185. Agentic Coding in the Wild: Characterizing GitHub Copilot Traces at Production Scale


186. H+ Embedding: Harmonizing Global and Token-Level Retrieval with Context-Dependent Phrases


187. RAG-TESTER: Automated End-to-End Testing of Retrieval-Augmented Large Language Models


188. Linguistic Context Recodes Visual Representations in Vision-Language Models


189. SIRIN: A Unified Toolkit for Detecting Contextual Hallucinations in Retrieval-Augmented and Memory-Grounded LLM Systems


190. Nova: An End-to-End MLIR Compiler for Deep Learning


191. Motif-Mamba: network motif improved mamba for long-range sequence modeling


192. Request-Level Energy Attribution for Batched LLM Serving


193. Memory Reward Inflation in Self-Improving LLM Agents


194. Optimization and Constraint Modeling using LLMs with a Retrieval Augmented Generation Process


195. CoT-Core: Accelerating LLM Evaluation via CoT-Aware Coreset Selection


196. Energy Efficiency of Locally Deployed LLMs: A Preliminary Quantitative GPU Power Benchmark on Consumer Hardware


197. Enhancing LLMs with Context-Specific Knowledge for Mitigating Misinformation in SMEs: A RAG-based Modeling and Analysis


198. AutoFOAM: The Self-Refining Autonomous OpenFOAM Agent


199. Revisiting Classic Thought Experiments to Measure Consciousness for Artificial Intelligence Safety


200. Bridging Artificial Intelligence and Power Systems Education Using a Hands-On Executable Framework


201. UEmbed: Unified Sparse and Dense Multimodal Embeddings


202. CoWAM: Coordination Contracts for Selective Policy Intervention with WAMs


203. Structured Memory for Edge Language Models: Persistent Context and Corpus Retrieval via O(1) SSM State Injection


204. Who Should Be Generated? Justifying Demographic Targets in Open-Ended Generation


205. Analytic Planning under Uncertainty with Moment Closure


206. SWE-Touch: Benchmarking Coding Agents When Users Touch the Code


207. DyFrDet: Towards Accurate Small Object Detection via Dynamic Frequency Suppression with Label Disambiguation


208. Action-grounded tissue affordance enables anticipatory auto-framing that lowers surgeon cognitive workload during laparoscopic surgery


209. Grounding Agentic VLMs with Dedicated Segmentation for Fine-Grained Vehicle Damage Assessment


210. Syntax Meets Semantics: Understanding Scientific Formulae


211. Agentic Incident Response through Digital Twin-Enhanced Multiscale Planning


212. Human-Centered Reflections on Care Robots: A Comparative Study of Caregiver Perspectives


213. Antares: Foundation Models for Agentic Vulnerability Localization


214. From fragmented data to actionable design: Physics-calibrated learning for plastic upcycling


215. Can Foundation Models Hear What Made That Sound? A Tiered Benchmark of Audio-Language Models and Traditional Classifiers for Closed-Set Sound Source Identification


216. GROVE: Growing and Reasoning over Temporally Stratified Memory from Streaming Video Experience


217. GLAIM: Learning Global and Local Adaptive Inter-Variable Dependency for Multivariate Time Series Imputation


218. Can AI Agents Simulate A/B Test Outcomes? A Validation Framework for Agentic Experimentation


219. Diffusion Policy with Behavioral Advantage Correction for Offline Reinforcement Learning


220. Context-Aware Mixture of Domain Experts for Bodily Expression of Emotion in the Wild


221. FastGFDs: Efficient Validation of Graph Functional Dependencies with Desbordante


222. BRiG-AFA: Bellman Risk-to-Go Learning for Non-Myopic Active Feature Acquisition


223. TS-MAMP: A Remanufactured Agricultural Robot Powered by Second-Life EV Components and NMS-Free On-Device Weed Detection


224. Open-Set Visual Text Forensics via Sparse-Constraint Rectified Flow


225. HarMoE: Multi-Source Chest Radiograph Pretraining with Dataset-Disentangled Experts


226. Assessing the Impacts of Imperfect Datasets on Client Selections in Federated Learning


227. Fast Discovery of Inclusion Dependencies with Desbordante


228. Lossless Tensor Compression as Program Synthesis


229. RamanPFN: learning from Raman spectral structure with a tabular foundation model


230. PhyCheck: Fine-Grained Evidence-Grounded Dataset for Physical Law Understanding in Video-LLMs


231. UniqueSplat: View-conditioned 3D Gaussian Splatting for Generalizable 3D Reconstruction


232. Self-Improving Large Language Models via Progressive Experience Evolution


233. IACM-RL: Intent-Aware Context Management and Reinforcement Learning for Complex Tool Invocation under Dynamic Intent Fluctuations


234. Uncertainty-Aware Crossmodal Fusion for Classification of Animal Behavior


235. DeGS: A Scalable 3DGS Architecture via Decoupled Workload Parsing and Reorganization


236. How Much Does a Reasoning Summary Reveal? An Observability Ladder for Large Language Models


237. An AI-Based Decision-Support Pipeline for Day-Ahead Photovoltaic Forecasting


238. Geometry-Guided Layerwise FFN Width Allocation in Transformers


239. TBSG-Net: Temporal Bipartite Scene Graph Network for Fine-Grained Video Moment Retrieval


240. TextNCA: Neural Cellular Automata for Language Modeling via Hierarchical Local Attention


241. CompanionBench: A Theory-Anchored, Real-World-Grounded Benchmark for AI Emotional Companionship


242. MANGO-Grasp: Mahalanobis Fields over Geometry-Oriented 3D Gaussians for Cross-Embodiment Dexterous Grasping


243. TALSC: Timeliness-Aware Large-Small VLM Collaboration for Infrastructure-Assisted Autonomous Driving


244. SPARE: Structural Parameter-Free Affinity Regularization for Flow Matching


245. AdaThinkV: Adaptive Thinking for Token-Efficient Video Reasoning


246. Music Restoration via Latent Operator Optimization and Diffusion Model Priors


247. FAST-GS: Frequency Aware Space-time Gaussian Splatting for Photorealistic Dynamic Novel View Synthesis


248. Agentic Self-Healing for Data and AI Pipelines: An Affordable Vendor-Agnostic Architecture using Open-Source Software


249. Divisive Normalization Shapes Low-Rank Slow Manifolds for Continuous Working Memory


250. Semantic Networks as Clues: A Theoretical Foundation and Process Optimization for Semantic Network Construction


251. Automatic Annotation of Ancient Greek Vowel Length


252. Recompute or Reuse? Diagnosing and Mitigating Textual Shortcuts in VLM Self-Reflection


253. Effective and Efficient Context Retrieval via Partial Dependency Graph for Repository-Level Code Generation


254. TransNRank: Towards Accurate Neoantigen Ranking with Transformer


255. Energy-Efficient LLM Serving via Disaggregated Attention–FFN and Flexible Frequency Scaling


256. Hear, Invoke, and Understand: A Skill-Calling Multimodal Agent for Large Audio Language Models


257. LAB-Tab: LLM-Augmented Bayesian Network Adaptation for Few-Shot Tabular Generation


258. No One Wins in Nuclear War: A Social Simulation of Military Decision-making


259. Beyond Magnitude and Shape: A Direction-Aware Loss for Time Series Forecasting


260. Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills


261. DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents


262. PartMat: Material-Aware 3D Part Decomposition with a Single Global Latent


263. Predictive Maintenance: Deep Learning-Based Remaining Useful Life Prediction for Combat Aircraft Engines


264. LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation


265. Illuminating Visual Identity in Universal Multimodal Embeddings


266. PICopilot: An LLM-based Agentic Framework for Assisting Photonic Integrated Circuit Design via Script Generation


267. Radar Detection in the CBRS Band: Techniques, Challenges, and Future Directions


268. Investigating Social Bias in Narrative Image Generation


269. Multi-Source Dynamic Graph Learning for Compound-Flood Forecasting in Managed Coastal Systems


270. EntailLLM: Verifying LLM-Generated Vulnerability Discovery Paths with Domain Knowledge via Logic Programming


271. Can Urban Blight Be Accessed with Vision-language Models: A Case Study in Detroit


272. SPECTRA: Band-Routed Embedding and Stage-Wise LoRA for Cross-Sensor Fine-Tuning of Geospatial Foundation Models


273. Disagree to Accelerate: Closing the Loop on Diffusion Feature Forecasts


274. X-KGRank: A Knowledge Graph RAG Framework for Explainable Recommendations via Pattern Mining and LLM Re-Ranking


275. TIDES: A Longitudinal Bilingual Dataset for Modeling Multi-Party Social Dynamics


276. When Extreme Darkness Meets Motion Blur: MeanFlow for Unified RAW Restoration


277. MNC: Scope-Bound Semantic Declassification for Private LLM-Agent Communication


278. Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch


279. Rethinking Generative AI Literacy: An Integrative, Developmental, and Dialectical Framework for K-12 Teacher Education


280. Entity-Aware Sequence Transduction for Player-Centric Ball Action Spotting


281. ARM: Detector-Agnostic Changepoint Attribution with Finite-Sample Error Control


282. ProtoAct: Turning Wet-Lab Protocols into Embodied Robotic Actions


283. Learning What to Remember: Test-Time Training via Context Distillation


284. Style Wins, Substance Loses: A Diagnosis of LLM-as-Judge in Idea Generation


285. Few-Shot Concept Prompt Learning for Segmentation Foundation Models via Visual Grounding


286. SyncPlan: Long-Horizon LLM Coordination with Explicit Synchronization and Adaptive Correction


287. CRAFT: Compression via Recursive Adaptive Fusion of Video Tokens for Vision-Language Models


288. StreamTalk: Streaming Co-Speech Gesture Generation with Key-Pose Anchoring


289. AI-assisted Script Management for Requirements Elicitation Interviews


290. RING: Retrieval-Internalized Generation for Continual Large-Scale Knowledge Injection


291. QWRF-Net: A Quantum-Wavelet Framework with Rectified Flow for Short-Term Precipitation Nowcasting


292. Linear Multi-Timescale Retention as a Memory-Efficient Vision-Language Bridge


293. PICTURE: Enhancing Theory-of-Mind in Large Language Models by Revealing, Not Hiding, Characters’ Lack of Knowledge


294. HindSearch: Trajectory-Level Hindsight Critique for Search-Augmented Reinforcement Learning


295. The Label Defines the Timescale: Trait-State Limits of Temporal-Aggregate Learning


296. Measuring in-context algorithmic reasoning in language models against an exact Bayes-optimal standard


297. Enhancing Visual Perception in Foggy Conditions via Multiclass Fog Density Modeling


298. Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning


299. Question Begets Question: Self-Evolving Curriculum for Reinforcement Fine-Tuning on Competition Mathematics


300. Deep Agentic Search for Repository-Level Code Question Answering: An Empirical Study


301. Rapid Embodiment Adaptation for Quadrupedal Locomotion


302. VGER: Voxel-Guided Global Event Ranking for Event Cloud Attribution


303. Retrieval Augmented Biomedical Question Answering with Weak Question Recovery and Neural Reranking for BioASQ Task 14b


304. Same violence, different answer: how AI responds to coercive control against women across languages


305. Statistical Mechanics of Learning on Product Wasserstein Manifolds


306. When Replanning Becomes the Bottleneck: Budgeted Replanning for Embodied Agents


307. Demystifying When and Why VLAs Fail in Contact-Rich Tasks and How to Fix Them


308. TabDPT-Turbo: Efficient In-Context Learning for Tabular Prediction


309. Language Equality has a Price: A Systematic Investigation of Multi-turn LLM Performance for EU-24+


310. Why Formal Monitors Fail: Attack Distribution Entropy as a Coverage Bound for LTL-Based LLM Agent Safety


311. Imprecise Belief Fusion Improves Multi-agent Social Learning


312. Asking Questions the Right Way: A Multi-Agent Conversational System for Prompt Formulation in Complex Task Resolution


313. Spatiotemporal Proximal Causal Inference under Hidden Confounding and Interference


314. DeVIT: Low-Power Vision Transformer Acceleration Using Delta Computation


315. LongChart VQA: A Comprehensive Benchmark for MLLMs with Complex Multi-Chart Reasoning


316. Context Compaction Theory


317. Dense Language Generation Made Simple: Deterministic, Randomized, and Multi-Order Algorithms


318. Sheaf-theoretic Signal Processing on Graphs: Spectral Theory, Filtering, and Sampling


319. Ranking Image Fusion the Way Humans Do: A Learned Pairwise Preference Metric for Infrared-Visible Fusion Assessment


320. UDT: Reconciling U-Nets and Diffusion Transformers with Data-Adaptive Token Reduction


321. Stop When Memory Suffices: Evidence-Conditioned Progressive Execution for LLM Agents


322. Training nGPT


323. Riemannian Attention Mechanisms for Transformers: A Theoretical Framework and Architecture Design


324. Rethinking Video Token Compression with a Global Codebook: Learning Once, Compressing Everywhere


325. ACE-GraphRAG: Agentic Context Engineering for Hierarchical GraphRAG


326. Auditing Semantic Gains in Sequential Recommendation: A Lightweight Recovery Test


327. AdaHAT: Adaptive Hard Attention to the Task in Task-Incremental Learning


328. It’s the Decoding Format, Not the Perturbation: Auditing Consistency-Based Selection for Vision-Language Test-Time Scaling


329. ReBRAC-v2: The Return of the King


330. Talking to Digital Twins: Selective Disclosure and Belief Measurement in Financial Social Media


331. DynActiveGS: Active Gaussian Splatting for Dynamic Scene Reconstruction


332. Hybrid Lagrangian-Eulerian Model for Lagrangian Fluid Simulation


333. Policy Optimality Measurement for Multi-Vehicle Decision-Making: From Extrinsic Indicators to Intrinsic Quality


334. SG-Layout: Structured Scene Graph-Guided Layout Generation with LLMs


335. FL-OA: A Byzantine-Robust Federated Learning Framework with Outsourced Auditing for Intelligent Devices


336. Attend to Your Own Thoughts: Breaking the Barrier for Post-Training Quantization of Reasoning LLMs through the Lens of 1.58-Bit Quantization


337. Credit the Right Box: Marginal Contribution Assignment for Structured Visual Perception


338. DeBERTa-Sentinel: Toward Transparent and Trustworthy Detection of AI-Generated Text


339. Decoy Images Amplify Caption-Mediated Defenses Against Encoded Jailbreaks


340. What Could the Agent See at 19:05? Generating Temporal Enterprise Scenarios from Real Research and Replaying Them to Evaluate Agents


341. WAM-Diff2: Hierarchical AR-to-Diffusion Distillation for Highly Efficient Autonomous Driving VLA


342. CallScreenBench: Benchmarking On-Device Models as Phone Secretaries


343. VLAGuard: A Framework for Evaluating and Mitigating Physical Attention Hijacking in Vision-Language-Action Robots within Wireless Sensor Networks


344. Stress-Relief Annealing: Polynomial-Time Simulation-Free Layout Optimization for Automated Warehouses


345. Caliber: Cross-Architecture Extraction-Cost Control for Score-Returning APIs


346. Can Humans Dream of Electric Sheep? Human-Written Samples for Fine-Grained Vision-and-Language Hallucination Benchmarking


347. Why LLMs Give In: Conversational Factors and Reasoning Behind Medical Sycophancy


348. KING: Embodiment-Aware Kinematic Graph Neural Network for Unified Motion Representation of Legged and Wheeled Robots


349. Cloud-ScPO: Hidden-State Geometry for Semi-Supervised Preference Optimization in LLM Reasoning


350. MedUPS: Towards Diagnostic Assistance in Uncommon Medical Cases with Large Language Models


351. Hierarchical Solomonoff Induction: An Unbounded Machine Learning Model


352. Who Belongs in the Eval Set? A Capability-Taxonomy-Driven Pipeline for Curating Regression Eval Sets in Agent-Extensibility Platforms


353. Beyond Gene Reconstruction: Learning Cell Representations through Complementary Transcriptomic Views


354. One-Sided Quantile Coupling for Flow Matching


355. An AI Approach to Verified Production Cryptographic Libraries


356. The Epistemic Politics of AI Anthropomorphism


357. GraRe: Grasp Candidate Re-Ranking for Frozen 6-DoF Grasp Detectors


358. Temperature-driven inversion and nonlinear dynamics in ChatGPT-like AIs


359. Neuro-Symbolic Participation Governance for Verifiable AI Agents in Open Digital Twin Ecosystems


360. RefactorAssist: Agentic Refinement for Reliable Code Refactoring


361. REIMU: Efficient Heterogeneous Hierarchical Reasoning for SSL-Based Speech Deepfake Detection


362. Deep Learning CNN and Recurrence Analysis for Alpha Gamma EEG Biomarkers in Fragile X Syndrome


363. Anticipatory Digital Twins for Online Head-and-Neck Adaptive Proton Therapy via Foundation-Model Registration


364. Less Is More: Tuning Configurable Systems with Imperfect Fidelity


365. CN101 - A Digital Thermodynamic Computer for Generative AI


366. Me and My Bot: What Users Talk About in AI Companion Communities on Reddit


367. When Prompts Control Robots: Prompt Injection Attacks in Multi-Agent Robotic Systems


368. Multi-tenant Kubernetes Use Cases for AI, Secure Computing and Data Services, and More


369. EduPluginBench: Executable Assurance for AI-Generated Educational Plugins


370. An Embedded RISC-V Evaluation of Kolmogorov–Arnold Networks in Hard-Constrained Recurrent Physics-Informed Models


371. Adversarial Attacks in Multi-Agent LLM Pipelines: Unveiling Structural Vulnerabilities in Agentic AI Architectures


372. Coverage-Driven Adaptive Keyframe Selection for Video Understanding


373. Supporting Cybersecurity Risk Management for Medical Devices via the SECUMAN Ontology and Shapes


374. From Chasing Ghosts to Missed Attacks: Perspectives and Perceptions of SOC Practitioners on LLM Integration, Risks, and Readiness


375. Understanding Online Failure Prediction in Linux Through Complementary Multi-View Explainability


376. Learning-Based Motion Planning for Dynamic Environments: From Foundational Algorithms to Emerging Paradigms


377. An Information Theoretic Treatment of Yager’s Probability Distribution Negation


378. Element-Aware Group Learning for E-Commerce Image Generation


379. A False Average: Chain-of-Thought Monitors Collapse Where They Are the Only Defense


380. Loanword or Switch? The Annotation Boundary, Not the Model, Drives Kazakh-Russian Code-Switching Identification


381. UOT-IR: Structured Routing of High-Polyphony Symbolic Music into Fixed-Budget Representations


382. Relax Within, Balance Across: Geometry-Guided Load Balancing for Vision-Language Mixture-of-Experts


383. Latency-Tolerant Cloud-Edge Collaborative Vision-Language-Action Models via Emergent Representational Specialization


384. Fairness Auditing: Lower Bounds on Company Manipulation


385. Crushing the Evidence: A Dual-Penalty Evasion Framework for Fooling White-Box Explainable AI Auditors


386. AiFlow: Token-Native Reactive Orchestration with Bounded Backpressure for Streaming LLM Applications


387. DexMani: Human-Derived Manipulability Guidance for Dexterous Rotation


388. A Context-Aware Cultural Heritage Guide Powered by LLMs


389. Robust Watermarks Meet Backdoored Models: Evading Diffusion Semantic Watermarks via Stealthy Backdoor


390. Native Multilingual Chain-of-Thought Reasoning in Low-Resource Southeast Asian Languages


391. Unleashing the Power of Text: Text-Guided Flow Matching for Image Fusion under Complex Degradations


392. SSTG-Nav: Metric-Grounded Spatial-Semantic Topological Graphs for Reusable Object Navigation


393. Rethinking and formalising the state across languages: a unified computational learning theory account


394. Auditable Release Control for Pedagogical Leakage in LLM Tutors


395. RadYOLO: Computationally Efficient 3D Object Detection and Segmentation in CT and MRI


396. CrossProjection: Geometric Grounding Beyond Viewpoint Change in Architectural Drawings


397. CeQe: Grounding Lexical Retrieval in Semantic Evidence


398. Structured Proxy Features for Multimodal NSCLC Survival Prediction from Pretreatment CT


399. Beyond Static Anchors: Bounded Prototype Conditioning for Language-Free Medical Anomaly Detection


400. Distilling Reasoning Traces into Advisory Prompts for Software Engineering Tasks


401. AdaMTP: An Adaptive Training Paradigm for Multi-Token Prediction


402. Unleashing the Potential of Large Language Models: A Blueprint for Real-Time, Enterprise-Ready Deployments


403. Boosting Generalizable Depth Estimation in Endoscopy by Mixture of Lightweight Experts and Intrinsic Image Alignment


404. DSETA: A Dual-Stage Continual Learning Framework for Travel Time Prediction in Dynamic Traffic Environments


405. Verifiable Checks for Business Rule Consistency


406. The Gate, Not the Cache: Gate Provenance Bounds the Closed-Loop Reliability of Training-Free VLA Token Skipping


407. Pretrain on Small Synthetic Data, Scale Large for Free: Symmetry-Aware Foundation Model for Logic Rule Induction


408. Tensor Probabilistic Model Checking of Finite-Horizon Markov Chains (Extended Version)


409. Artificial Intelligence and Modeling & Simulation: An Overview


410. Artificial Intelligence for the Characterization of Particles and Fibers by Optical Microscopy


411. ORCA: ORgan-Centroid Aggregation for Training-Free 3D CT Visual Token Compression


412. OrEdge: Efficient Multi-Modal Anomaly Detection in Distributed Software Systems via Orthogonal-Domain Learning


413. Sixteen models, fewer than two voices: measuring ensemble dispersion where no answer is uniquely correct


414. Hybrid Attention Estimation Pipeline for Adaptive HRI Using an Expressive Robotic Head


415. Interpretability-Guided Soft Pruning of Attention Heads in Vision Transformers


416. Cross-Task Dissociation in Frontier Vision-Language Model Theory of Mind


417. Hierarchical BM25: Lexical Search at Billion-Document Scale


418. Evidence-Unit Fairness and the Limits of Query-Adaptive Sparse-Dense Fusion in Financial Document Retrieval


419. Cross-Benchmark Generalization in Long-Horizon Agents


420. Inference-Time Policy Alignment for Fair Reinforcement Learning


421. Response Magnitude as a Dominant Signal for Held-Out CRISPRi Perturbation Effect Prediction


422. Optimising for Flourishing: Flourishing Metrics and Return on Flourishing as Success Criteria for Artificial Intelligence and Post-AGI Economic Systems


423. Exposed by Design: A Dynamic Security Assessment of Internet-Facing MCP Servers at Scale


424. A Synthetically-accessible Universe of Chemically Recyclable Polymers


425. DiffusionGemma Technical Report


426. Symbolic Attack Chain Generation from Atomic Red Team Techniques: An Empirical Study of Predicate Representation Granularity


427. A Fortran General-Purpose Transpiler: Proof of Concept


428. LLM-OSDA: An Optimal-Stopping Dynamic Auction for Native Advertising in Multi-Turn LLM Conversations


429. Counting the Cost of War Under Satellite Embargo: Zero-Shot Estimation of Impacted Infrastructure


430. EEG-JEPA: Structured Latent Prediction for EEG Foundation Models


431. MetaRoute-Bench: Evaluating Meta-Decision Policies for Agentic Workflow Routing


432. Skillsets on the Chain: A Blockchain-based Zero-Trust Framework for Agentic AI Networking


433. SPARC-Rad: A Multimodal Benchmark Dataset and Evaluation Pipeline for Spatial and Anatomical Reasoning in Radiology Vision-Language Models


434. LLMBDC: Language Model for Biological Domains Oriented Clustering of Gene Ontology


435. GRAIN: Molecules Are Not the Right Granularity – Active-Ingredient Modeling for Safe Medication Recommendation


436. Conservation laws determine what physical learning remembers


437. Logographic Character Visual Pretraining via Semantic-based Contrastive Learning


438. SymNet: A Multi-Task Network for Joint Radio Map Reconstruction and Transmitter Localization


439. Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs


440. Empirical investigation of 3D CT Foundation Models and Unsupervised Adaptation for Head and Neck Cancer Recurrence Prediction


441. ELECTRIC: Evidential Learning-Enhanced CT Reconstruction via Iterative Correction


442. Neural Circuit Function Inference with LLMs


443. Automated ECG Interval Measurement and Wave Delineation Using Fast Fourier Convolution ResNet


444. Not All EEG Moments Are Equal: Position-Adaptive Time Scheduling for EEG Generation


445. Multimodal Wearable-Based Olfactory-Induced Emotion Recognition in Arousal-Valence Dimensions


446. Trustworthiness Costs of Domain Adaptation in Small Language Models:A Cross-Architecture Empirical Study


447. Google’s AI & Economy ATLAS v1.0: Mapping Gemini Usage in the Economy


448. Fast Generation of Representative Synthetic Dataset with Salsa to Train ATR Models with Electromagnetic Couplings Data-Augmentation


449. XL-DocBench: Benchmarking Evidence-Grounded Extra-Long Document Understanding


450. SLMs as Multi-Agent Routers: A Progressive SFT and Reinforcement Learning Approach


451. Width, Memory, and Delay: A Resource Accounting for the Limits of Flat Multi-Agent Systems


452. Exploring More to Solve More: Boosting Diversity in Text Diffusion Models via Entropy-Based Guidance


453. Role Steering of Language Models for Social Simulations


454. Uncertainty-Aware Simulation-Based Inference for Operations Research with Large Language Models


455. CITBench: A Comprehensive Benchmark for Interactive Tabular Data Processing with LLMs


456. What Transfers from Text to Vision? Capability Scaling Laws and Transfer Dynamics for VLMs


457. Obshazard-bench: Benchmarking Multimodal Foundation Models for Real-Time Disaster Intelligence from Raw Earth Observation Streams


458. DLLM-TTS: Block Discrete Diffusion Language Model for Text-to-Speech Synthesis


459. AgentMemBench: A Systematic Benchmark for Evaluating Long-Term Memory Management Strategies in Conversational AI Agents


460. MemoryForge: Synthesize Lifelong Memory for Human-Like LLM Agents


461. RubricReviewer: From Direct Critique to Objective and Comprehensive Rubric-Driven Peer Review


462. Cost-Effective Automated Judging of Natural-Language Mathematical Proofs


463. Corrigible Assistance in One Round: Pragmatic-Pedagogic Best Response


464. Amplitude-Only FFN Intervention for Tool-Structured LLM Inference Method: Gated Evaluation Protocol, and Cross-Model Empirical Results