전체 AI 논문 - 2026-07-22

1. CodeRescue: Budget-Calibrated Recovery Routing for Coding Agents


2. Agents in the Wild: Where Research Meets Deployment


3. Associative Emotional Learning in Convolutional Neural Networks


4. ResearchArena: Evaluating Sabotage and Monitoring in Automated AI R&D


5. LLM Detection as an Intervention: Downstream Impact under Strategic User Behavior


6. Graph-Based Agentic AI with LangGraph: Workflow Pathways for Long-Running Stateful Business Processes


7. BioSecBench-Surveillance: A Verifiable Benchmark for AI Agents in Pathogen Genomic Surveillance


8. Sequential Learner Modeling Using Multi-Relational Graph Convolutional Networks


9. Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning


10. OpenRTAG: A Comprehensive Benchmark for Robust Text-Attributed Graph Learning under Data Quality Degradation


11. Supra Cognitive Modes: A Routed Architecture for Agent Memory


12. On the Effectiveness of Pretraining for Graph Combinatorial Optimization


13. Quality Action Assurance: Multimodal Verification of Examiner Claims in VR OSCEs


14. Vector-Bench: Can Models Surgically Edit SVG Code?


15. Athena-Brain Technical Report: An Efficient Robot Brain for General Intelligence and Embodied Interactio


16. Fishing Out Free Riders: Shapley-Based Reward Attribution for Parallel Reasoning via Reinforcement Learning


17. Mi-Memory: A Lifecycle Memory Framework for Personal AI


18. Measuring Reward-Seeking via Contrastive Belief Updates


19. From Dependency to Compositionality: A Neurosymbolic Lifting of LLM Outputs via Combinatory Categorial Grammar


20. What General Intelligence Requires: Non-Reducible Constraints Across Levels of Description


21. OntoBook: Ontology-Grounded Synthetic Textbooks for Medical Encoder Pretraining


22. Enhancing Transformer-based Routing by Encoding Distance via Relative Positional Encoding


23. Black-Mamba: Biologically-Inspired Leaky Accumulation for Conceptual Knowledge under Distribution Drift


24. NaviAIS: A Scenario-Level Vessel Trajectory Prediction Dataset withVectorized Lane Priors and the NaviLane Forecasting Framework


25. PhoenixRepair: Rethinking Repair Strategy Exploration in Software Agents


26. Evaluating medical AI under missing information: same-provider judges and human raters change apparent safety


27. AI Tour Meeting: Group Travel Planning by LLM Agents


28. SkillSight: Seeing Through Shared Descriptions for Accurate Skill Retrieval


29. AgentDebugX: An Open-Source Toolkit for Failure Observability, Attribution, and Recovery in LLM Agents


30. One Rewrite to Fix Them All? Type-Aware Repair Allocation for Text-to-Image Prompt Optimization


31. DWM: Separating World Effects from Actions in Latent World Models


32. Do AI-Native Biotechs Need Departments? Benchmarking Company World Models for AI-Driven Drug Development


33. Semantic Primes as Explanans for Emotion in Large Language Models


34. SciHazard: A Benchmark for Measuring Scientific Safety Risks with Decomposed Harm Scoring


35. When Does Machine Learning Beat Value Sorting? A Three-Dataset Diagnostic of Exposure-Weighted Shipment Prioritization


36. Attacking Graph Foundation Models Through Their Shared Representation


37. Engineering Trustworthy Agentic AI for Critical Systems


38. MAGE: Human-Like Macro Placement via Agentic Multimodal Reasoning


39. Neuro-Symbolic Meta-Policies for Temporal Knowledge-Graph Memory under Partial Observability


40. AlayaWorld: Interactive Long-Horizon World Modeling – Full Technical Report


41. Operational Hallucination and Safety Drift in AI Agents


42. Deep Reinforcement Learning to Master the Asymmetric Strategy of Baghchal


43. Using LLMs for Explainable, Data-Driven Insight Generation from Time Series


44. Trajectory-Aware Clinical Risk Prediction via Severity-Grounded Knowledge Graphs and Retrieval-Augmented Generation


45. Wisdom of LLM Crowds: Aggregation and Contamination in Language Model Ensembles


46. Fence: Specialized SLM Guardrails for LLM Applications


47. Structured Synthetic Reasoning Data for Arithmetic Fine-Tuning of Small Language Models


48. State Compression in Two-Agent LLM Relays: A Closed-World Study of Constraint Preservation


49. MUX: Continuous Reasoning via Multiplexed Tokens


50. Position: AI/ML Deepfake Research is Misaligned with AI-Generated Non-Consensual Intimate Imagery (AIG-NCII)


51. ProbSPARQL: Querying Knowledge Graphs with Multi-dimensional, Uncertain Numeric Data


52. When JSON Is Not Enough: Semantic Reliability of Schema-Constrained LLM Ordering Agents


53. FindStatBench: Evaluating Large Language Models on Combinatorial Code Synthesis


54. Probabilistic Concept-Aware Steering for Trustworthy LLM Inference


55. S2T-RLHF: Hierarchical Credit Assignment for Stable Preference-Based RLHF


56. PEARL: Solver-in-the-Loop Interactive Optimization Modeling from Natural Language


57. Semantic Cooperative Games for Contribution Attribution in LLM-Based Multi-Agent Systems


58. Cross-Dialect Generalization Without Retraining: Benchmarks and Evaluation of Schema-Derived Constrained Decoding for MLIR


59. Beyond Accuracy and Cost: Latency-Aware LLM Query Routing for Dynamic Workloads


60. MILP-Evo: Closed-Loop Fully Automatic Design of MILP Solvers


61. Integro-differential equations in angular stabilization of drone motion by distributed feedback control


62. Phionyx: A Deterministic AI Runtime Architecture with Structured State Management and Pre-Response Governance


63. SAAG: Structured Agent Assessment and Grounding


64. From Agent Failure Paths to Quantified Residual Risk: A Compositional Framework for Resilient Agentic AI


65. AI Tool Discovery at Scale: All You Need is DNS


66. BatchDAG: LLM-Planned Execution Graphs for Scalable Ad-Hoc Analysis Over Enterprise Data


67. Calibrated Selective Fact-Checking via Evidence Chain Evaluation


68. SysAdmin: Measuring Instrumental Power-Seeking in Frontier AI


69. Copy Less, Ground More: Overcoming Repetitive Copying in Long-Context Reasoning via Evidence-Aware Reinforcement Learning


70. Appearance Pointers – Multimodal Region Control of Diffusion Transformers


71. Provable diffusion-based posterior sampling for linear inverse problems via DDIM


72. ISO: An RLVR-Native Optimization Stack


73. Off-Context GRPO: Learning to Reason on Hard Problems using Privileged Information


74. From Distances to Trajectories: Real-Time Signed Distance Function Mapping and Distance-Accelerated Motion Planning for UAVs


75. Riemannian Deep Learning:Modules, Networks, and Geometries


76. The safety failures we are not instrumenting: a perspective on hidden safety-critical challenges in modern AI systems


77. GUIDED Network-Agnostic Feature Initialization for Spatial Transferability in GNN-based Models


78. They’ll Verify. They Just Won’t Act. How Authority Framing and Laundered Code Turn a Trusted Agentic CI/CD Pipeline Into an Attack Surface


79. Toward Auditable Fraud Detection: Combining Graph Features, Model Explanations, and Agentic Case Investigation


80. PathAgentBench: Benchmarking Evidence-Seeking Vision-Language Models on Whole-Slide Pathology Image


81. Benchmarking Generalization in Financial Statement Fraud Detection: robust evaluation and novel tasks


82. Prompt Design at Scale: How Format, Instruction Count, and Context Length Shape Instruction Adherence and Hallucination in Large Language Models


83. Inference-Time Steering for Cross-Lingual Factual Consistency in LLMs


84. The Price of Reasoning: Cost-Quality Tradeoffs in Reinforcement Learning for Neural Machine Translation


85. Beyond Score Prediction: LLM-Based Essay Scoring and Feedback Generation via Reinforcement Learning with Rubric Rewards


86. Computing on the Fly: Navigating a Vision for the Future of Drone Computing


87. Assessment in Team Problem-Solving Exercises in Computing Education


88. MIRA-Ev:A Benchmark for Granular Evidence Detection and Relational Reasoning in Clinical Exams


89. Free energy landscape of Dense Associative Memory


90. ABot-World-0: Infinite Interactive World Rollout on a Single Desktop GPU


91. Agentic Real2Sim: Physics-based World Modeling with Vision-Language Agents



93. Breaking the Homogeneity Assumption: Specialized Multi-Generator Adversarial Learning for Rare Failure Detection in Predictive Maintenance


94. Incomplete Observations Boost Evolutionary Performance in Ocean Modeling


95. MIRAGE: Multi-scale Lesion-Informed Representation with Auxiliary Guidance for MRI Contrast Enhancement


96. Parallel Noising in Neural Markov Logic Networks


97. Code Division Modulation Layers Against Forgetting and Inference in Continual Gait Identification


98. SciCodePile: A 128GB Corpus and Executable Benchmark for Challenging Scientific Code Generation


99. DAIS: Dependency-Aware Intermediate QA Supervision for Complex Reasoning


100. From Operations to Elderly Care Outcomes: A Thematic Review of Industrial Engineering and Decision-Support Approaches


101. Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing


102. Now You See the Hate: Adaptive View Retrieval for Hidden Hateful Illusions


103. Deep learning-based prediction of time-resolved adhesive forces in viscoelastic Hertzian contacts


104. Where Should Optimizer State Live? Tiered State Allocation for Memory-Efficient Mixture-of-Experts Training


105. Spectral Higher-Order Neural Networks Have Sharp Expressivity Bounds


106. FilmWorld: Agentic Novel-to-Film Generation through Dynamic Cinematic World Modeling


107. CoGoal3D: Collaborative 3D Object Detection with 3D-Aware Fusion and Refinement


108. Biological Amnesia in ICU Time-Series Prediction: A Drift-Adaptive Two-Stream Architecture with Temporal Retrieval


109. Computational Humor with Multimodal LLMs: Methods, Datasets, Evaluation, and Challenges


110. MedDDC-Eval: Diagnosis-Decoupled Evaluation of Multi-Turn Medical Consultation Agents


111. SWITi: Quantifying and Reducing Tiling Artifacts with Sliding Window Inner Tiling


112. AutoJourn: Multi-Perspective Summarisation, Bias Detection and Bias Neutralisation for LLM-Generated News in Automated Journalism


113. Verifiable Self-Evolution for Open-Ended Dialogue Skills via Future-Feedback Prediction


114. Skillware: A Software Ontology and Engineering Lifecycle for Persistent Behavioral Artifacts


115. Variational meta-learning inference for low dimensional neural system identification


116. SFGA: A Statistics-First Gating Architecture with Adjudicative Escalation for Trustworthy SFT Data Procurement


117. Dual Adversarial Fine-tuning for Enhancing Robustness of Large Vision Language Model


118. Functional Equivalence and Geometric Diversity in Neural Network Approximations: An Empirical Characterization


119. Circuit Claims Depend on What Is Extracted and How It Is Compared


120. Public perceptions of AI-driven decision-making in healthcare: A structural equation modeling approach


121. RAMP: Recognition parametrisation by Amortised Message Passing


122. Regime-Aware Physics-Guided Early Warning of Lithium-Ion Battery Thermal Runaway Using Thermo-Mechanical Signals


123. OPD-IAD: From Language Judgment to Industrial Anomaly Detection via On-Policy Self-Distillation


124. Data Leakage Prevention in Agentic Applications via Preemptive Hardening


125. ABOPD: Antibody CDR Design via On-Policy Distillation


126. From Trajectories to Instructions: Language-Conditioned Meta-Reinforcement Learning


127. Cross-Agent Campaign Attribution: Linking Asynchronous Attacks Across LLM Agents



129. AgentTrails: Towards Trust and Reuse for Agentic Tasks


130. Bounding Boxes to Improve Small Language Model Performance on Vision-Based Grading Tasks


131. ConceptCF: Concept-based Counterfactuals for the Explainability of Time Series


132. Find Before You Fine-Tune: A Diagnostic Study of Small LLMs for Cybersecurity QA


133. Strategy-Following Multi-Agent Deep Reinforcement Learning Considering Control Strategies Provided to Other Agents


134. What the Waveform Knows: Transparent-first Speech and Audio Intelligence with Caption Studio


135. Decoupled Pipeline with Proposal Reranking and Score Fusion for Positive-Unlabeled Marine Species Detection


136. Attributes Should Come from Images, Not Class Names: Distribution-Conditioned Attribute Selection for Vision-Language Models


137. Broken Gates: Re-evaluating Web Bot Defenses in the Age of LLM Agents


138. Deep Learning Estimation of Sex, Age, Height, and Weight from CT-derived Digitally Reconstructed Radiographs


139. Norm or Direction? Decoding Vision Mambas for High-Resolution Vision


140. CPInj: Uncovering Prompt Injection Risks in Textual Collaborative Prompt Optimization


141. Temporal-Causal Unity as an Operational Framework for Collective Dynamics: Causal-Progress Clocks, Synchronization, and Polarization


142. LatentMT: Machine Translation with Latent Reasoning


143. Mitigating Matthew Effect: Multi-Hypergraph Boosted Multi-Interest Self-Supervised Learning for Conversational Recommendation


144. Intelligent Multi-UAV Navigation in ITNTNs: A Hierarchical LLM Approach


145. AutoIndex: Learning Representation Programs for Retrieval


146. Planning as Emergent Behavior in Reinforcement Learning with Relational Hidden States


147. For What Reason? Interpreting Models’ Encoding of Causation and Antithesis


148. The Story Shapes the Agent: Narrative Priors in LLM Behavior


149. Operational Proto-Introspection in Looped Language Models: Process-Quality Taps, Executable Branching, and the Readout-Control Boundary


150. Censoring-Aware In-Context Learning for Generalized Supplier Lead Time Estimation in Supply Chain Planning


151. EduPanel: A Three-Agent LLM Judge for Teaching Videos – Reliability, Complementarity, and Human Trust Calibration


152. Automated Data Engineering and Feature Selection for the Case Study of Warpage Detection in Fused Deposition Modeling


153. Querying Multimodal Scientific Papers with AI: Practices and Preferences Across Blind, Low-Vision, and Sighted Scientists


154. Now We Know? A Systematic Comparison of TerraMind and THOR


155. Towards an Automated Test of LLM Security Knowledge


156. The Open Ant: A Robot Platform for Reinforcement Learning Research


157. Trusted Credentials, Untrusted Behavior: Benchmarking LLM-Agent Security in High-Performance Computing


158. Governing Well in the Algorithmic Age: The Foundations of Digital Statecraft


159. Structured Output Collapses Answer Diversity Across 44 Language Models


160. RRPO: Reference-Relative Policy Optimization with Stratified Conditional Rollouts


161. Competitive and Complementary Tools


162. Estimating Rare Events in Language Models with Proper Evaluation


163. CANDOR: Chance-Calibrated Discordance in Frozen Foundation Encoders


164. ChainMark: Model-Free LLM Watermarking with Closed-Form Calibration


165. Relay-Bench: Evaluating LLMs on Multi-Domain Reasoning Chains


166. Intelligence from Learnable Novelty


167. Adversarial Robustness of Phishing Email Detection: A Comparative Study of TF-IDF + Logistic Regression and Fine-Tuned DistilBERT


168. A Controlled Study of Attention-Only Transformers


169. Physical Self-Supervised Learning: IMU Sensing without Manual Labels


170. HALLMARK: Diagnosing Three Failure Modes in LLM Citation Verifiers


171. Decode-Time Grammars: Constrained LLM Generation over a Refinement Order of Grammar Fragments


172. CODENS: Transforming Code Changes into Living, Accessible, and Queryable Documentation


173. Multi-layer MIMO Relay as Deep Physical Neural Networks: Power Amplifiers as Activation Functions


174. MambaLSTM: A Spatio-Temporal Framework for Enhanced Traffic Accident Risk Prediction


175. An Analysis of Residual-Stream Geometry Across Transformer Depth


176. Addressing Limited Data in Auditory Attention Decoding with Diffusion Generative Models


177. FSDBN: Foreground-Aware EEG–Visual Alignment via Dynamic Brain Networks


178. Federated Lightweight Fine-Tuning


179. PRISM: Sensitivity-Aware PolynoMial PRuning for EffIcient Neural Network Encryption


180. Quantum Cryptanalysis on IBM Quantum Hardware: Extending Even–Mansour Period Recovery from $N=4$ to $N=10$


181. ChemHyperMag: Physics-informed magnetic hypergraph learning improves molecular ADMET prediction


182. Physics-Guided Masked Multi-Task Network for Edge-Friendly Battery Health Diagnostics from Sto-chastically Fragmented Charging Profiles


183. Dynamic Loss Balancing for Joint SOH and RUL Prediction of Lithium-Ion Batteries via a Rotary SOH-Injected Prior Battery Transformer


184. Hazard or Anomaly? Evaluating VLMs for Understanding Dangers and Discrepancies


185. Cost Accounting for Reactive Computational Graphs: Exhaustive Sweeps, Sequential Mutation, and the Backward-Locality Gap


186. Binding Drift in Multi-Step Tool-Augmented Agents


187. Approximating SPR Distance Between Phylogenetic Trees with Graph Neural Networks


188. Distribution-First Population Simulation: Collapse, Calibration, and Recall in Non-WEIRD LLM Persona Modeling


189. Agentic Calibration of Grey-Box Simulation Models: An LLM-Driven Alternative


190. Gradient-Energy Guided Block-Wise Perturbations for Sharpness-Aware Minimization


191. The Information Shadow: Measuring Structural Limits on What Language Models Can Learn


192. Reliability Scales Inversely: Bigger Models Compound Mistakes Faster via a Hidden Auto-Regressive Risk Regime


193. Dual-domain fused LSTM modeling for efficient time-dependent reliability analysis


194. SechKAN: Kolmogorov-Arnold Networks with Hyperbolic Secant Functions


195. Towards Principled Continual Anomaly Detection: A Systematic Framework and Benchmark Scenarios


196. BearingNAS: Obtaining In-Sensor Intelligent Fault Diagnosis Systems for Bearings Using a Laptop


197. Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit Signal Priority


198. Edge-Efficient Transformer for End-to-End RF Spectrum Monitoring


199. Compressing What Matters: Neuron Importance Meets Data-Aware Low Rank Approximation for Language Model Compression


200. FedCC: A Low-Resource Federated Adaptation of Foundation Models for Robust Corpus Callosum localization in Fetal Ultrasound Images


201. Beyond Single-Dimensional Compression: The Compound Sparsity Frontier of Large Language Models


202. Beyond Output-Space Calibration: Spectral Evidence Bundling for Selective Reliability Estimation in Time-Series Classification


203. FALCON-Discover: Discovering Concentrated False-Confidence Regions for Calibration


204. A Calculus of Discernment: Decision-Relevant Insight, Sequence Value, and Forgetting as Higher-Order Learning


205. Domain Design for the Cops and Robbers Problem


206. Market Strategy Evaluation for Prosumers in Local Electricity Markets


207. The Economics of Autonomy: Real-Time Risk Indexing for Insurable AI-Driven 6G Systems


208. Assistant or Actor? Student Trust, Control, and Delegation Regret When Using a General-Purpose AI Agent


209. MechAInistic: An LLM-guided Multi-Agent System for Reasoning over Genome-Scale Constraint-Based Metabolic Models