전체 AI 논문 - 2026-07-06

1. Distributed Attacks in Persistent-State AI Control


2. Online Safety Monitoring for LLMs


3. ReContext: Recursive Evidence Replay as LLM Harness for Long-Context Reasoning


4. What LLM Agents Say When No One Is Watching: Social Structure and Latent Objective Emergence in Multi-Agent Debates


5. G-RRM: Guiding Symbolic Solvers with Recurrent Reasoning Models


6. EvoPolicyGym: Evaluating Autonomous Policy Evolution in Interactive Environments


7. Automated grading of Linux/bash examinations using large language models: a four-level cognitive taxonomy approach


8. Text-Driven 3D Indoor Scene Synthesis in Non-Manhattan Environments


9. Fast Multi-dimensional Refusal Subspaces via RFM-AGOP


10. Steerability via constraints: a substrate for scalable oversight of coding agents


11. Hardware-Enforced Semantic Coordination for Safety-Critical Real-Time Autonomous Systems


12. DRIFTLENS: Measuring Memory-Induced Reasoning Drift in Personalized Language Models


13. Grounded autonomous research: a fault-tolerant LLM pipeline from corpus to manuscript in frontier computational physics


14. A Hippocampus for Linear Attention: An Exact Memory for What the Recurrent State Forgets


15. AgenticSTS: A Bounded-Memory Testbed for Long-Horizon LLM Agents


16. Copewell: A Multi-Agent Swarm Architecture for Equitable Mental Wellness Support


17. Purified OPSD: On-Policy Self-Distillation Without Losing How to Think


18. Criticality-Based Guard Rail Validation for AI Agent Decisions in Autonomous Telecom Networks


19. UA-ChatDev: Uncertainty-Aware Multi-Agent Collaboration for Reliable Software Development


20. A rubric-based controlled comparison of frontier language models on expert-authored clinical reasoning tasks


21. A$^{2}$utoLPBench: An Auto-Generated, Agent-Friendly LP Benchmark via Inverse-KKT Construction


22. Coding-agents can replicate scientific machine learning papers


23. Enhancing Fitness Intelligence through Domain-Specific LLM Post-Training


24. ContextNest: Verifiable Context Governance for Autonomous AI Agent


25. SUNTA: Hierarchical Video Prediction with Surprise-based Chunking


26. Evidence-State Rewards for Long-Context Reasoning


27. Algebraic Model Counting for Global Analysis of Optimal Decision Trees


28. PACE: A Proxy for Agentic Capability Evaluation


29. Hidden Forgetting in Continual Multimodal Learning: When Accuracy Survives but Grounding Fails


30. InduceKV: Fixed-Footprint Continual Adaptation of Multimodal LLMs via Inducing KV Memories


31. Traceable Fault Diagnosis for Battery Energy Storage Systems via Retrieval-Augmented Multi-Agent O&M Assistant


32. Episodic-to-Semantic Consolidation Without Identity Drift


33. Multimodal Knowledge Edit-Scoped Generalization for Online Recursive MLLM Editing


34. OntoLearner: A Modular Python Library for Ontology Learning with Large Language Models


35. Atomic Task Graph: A Unified Framework for Agentic Planning and Execution


36. A-TMA: Decoupling State-Aware Memory Failures in Long-Term Agent Memory


37. ElephantAgent: Contextual State Continuity in Agentic Systems


38. ContextSniper: AntTrail’s Token-Efficient Code Memory for Repository-Level Program Repair


39. Rethinking Complexity Metrics for LLM-Integrated Applications: Beyond Source Code


40. Spec-AUF: Accept-Until-Fail Training under Train-Inference Misalignment for Masked Block Drafters


41. SkillCoach: Self-Evolving Rubrics for Evaluating and Enhancing Agentic Skill-Use


42. CamoNAS: Neural Architecture Search for Enhanced Camouflaged Object Detection


43. Safety Targeted Embedding Exploit via Refinement


44. CLAP: Closed-Loop Training, Evaluation, and Release Control for Domain Agent Post-training


45. Actual causality in fault trees


46. Pre-Flight: A Benchmark for Evaluating Large Language Models on Aviation Operational Knowledge


47. MMIR-TCM: Memory-Integrated Multimodal Inference and Retrieval for TCM Clinical Decision Support


48. Safety Testing LLM Agents at Scale: From Risk Discovery to Evidence-Grounded Verification


49. Subliminal Clocks: Latent Time Modelling in Diffusion Language Models


50. Verifiable Knowledge Expansion through Retrieval-Grounded Formal Concept Analysis


51. Repair the Amplifier, Not the Symptom: Stable World-Model Correction for Agent Rollouts


52. SimWorlds: A Multi-Agent System for Dynamic 3D Scene Creation


53. Mastermind: Strategy-grounded Learning for Repository-Scale Vulnerability Reproduction


54. Path-level Hindsight Instructions for Semantic Exploration in Vision-Language Navigation


55. Meta-Benchmarks for Financial-Services LLM Evaluation


56. Reformalization of the Jordan Curve Theorem


57. DRL-CLBA: A Clean Label Backdoor Attack for Speech Classification via DDPG Reinforcement Learning


58. Distributionally Robust Listwise Preference Optimization


59. Generic Expert Coverage for Pruning SparseMixture-of-Experts Language Models


60. COMFYCLAW: Self-Evolving Skill Harnesses for Image Generation Workflows


61. Epistemic Goggles: A Pretrained Module that Induces an Epistemic Frame via Gradient Editing


62. Separating Expert Retention from Autonomous Source Inference in Raw-ECG-Replay-Free Continual ECG Deployment


63. Diverse Evidence, Better Forecasts: Multi-Agent Deliberation Under Information Asymmetry


64. Autonomous discovery of traffic laws with AI traffic scientists


65. Spatial Support Matters: Geometry-Aware Graph Fusion for Rainfall Field Reconstruction


66. Scaling with Confidence: Calibrating Confidence of LLMs for Adaptive Test Time Scaling


67. Profit-Based Counterfactual Explanations for Product Improvement: A Case Study of Manga Sales in Japan


68. SemHash-LLM: A Multi-Granularity Semantic Hashing Framework for Document Deduplication


69. Safe and Adaptive Cloud Healing: Verifying LLM-Generated Recovery Plans with a Neural-Symbolic World Model


70. Hawk: Harnessing Hardware-Aware Knowledge for High-Performance NPU Kernel Generation


71. EO-Agents: A Three-Agent LLM Pipeline for Earth Observation Hypothesis Generation



73. OPINE-World: Programmatic World Modeling with Ontology-error-Prioritized Interactive Exploration


74. Revisiting Chain-of-Thought Reasoning under Limited Supervision: Semi-supervised Chain-of-Thought Learning


75. Janus: a Playground for User-Involved Agentic Permission Management


76. The Agentic Garden of Forking Paths


77. Procedural Memory Distillation: Online Reflection for Self-Improving Language Models


78. World Feedback for Clinical Agents: Diagnosing RL in FHIR Environments


79. Beyond Next-Token Prediction: An RLVR Proof of Concept for Tool-Use Agents on Atlassian Workflows


80. Discrete Diffusion Language Models for Interactive Radiology Report Drafting


81. CreativityNeuro: Steering Language Model Weights to Improve Divergent Thinking and Reduce Mode Collapse


82. When Should Service Agents Reconsider? Difficulty-Routed Control in Customer-Service Operations


83. Agent4cs: A Multi-agent System for Code Summarization in Large Hierarchical Codebases


84. The Wiola Architecture for Efficient Small Language Models


85. Auto-FL-Research: Agentic Search for Federated Learning Algorithms


86. PACE: A Neuro-Symbolic Framework for Plausible and Actionable Counterfactual Explanations


87. LACUNA: A Testbed for Evaluating Localization Precision for LLM Unlearning


88. Program-as-Weights: A Programming Paradigm for Fuzzy Functions


89. Reasoning LLM Improves Speaker Recognition in Long-form TV Dramas


90. DemoPSD: Disagreement-Modulated Policy Self-Distillation


91. Beyond Adam: SOAP and Muon for Faster, Label-Efficient Training of Machine Learning Interatomic Potentials


92. Combating Textual Noise and Redundancy: Entropy-Aware Dense Visual Token Pruning


93. TestEvo-Bench: An Executable and Live Benchmark for Test and Code Co-Evolution


94. Human Capital, Not Model Benchmarks, Predicts Hybrid Intelligence in Forecasting


95. Learning to Move Before Learning to Do: Task-Agnostic pretraining for VLAs


96. OrbitQuant: Data-Agnostic Quantization for Image and Video Diffusion Transformers


97. Neuron-Aware Data Selection for Annotation-Free LLM Self-Distillation


98. Reasoning effort, not tool access, buys first-try reliability in agentic code generation: an observational study


99. WorldSample: Closed-loop Real-robot RL with World Modelling


100. QFedAgent: Quantum-Enhanced Personalized Federated Learning for Multi-Agent Activity Recognition


101. Neuron-Aware Active Few-Shot Learning for LLMs


102. ACID: Action Consistency via Inverse Dynamics for Planning with World Models


103. VisionAId: An Offline-First Multimodal Android Assistant for People with Visual Impairment, Featuring Personalized Object Retrieval


104. Understanding Agent-Based Patching of Compiler Missed Optimizations


105. World Wide Models: Literary Tools for Cultural AI


106. The Dual Nature of LLM Persona: Aggregated Tendencies and Frame-Dependent Geometry


107. Stable Self-Modulating Quantum Fast-Weight Programmers with Bounded Memory Gates


108. GAP-GDRNet: Geometry-Aware Monocular Visual Pose Sensing on a Single-Target Synthetic Spacecraft Dataset


109. SkillFuzz: Fuzzing Skill Composition for Implicit Intents Discovery in Open Skill Marketplaces


110. Self-Gating Attention for Efficient Time Series Forecasting


111. SelectTSL: Prompt-Guided Selective Target Sound Localization in Complex Scenarios


112. Generalization in offline RL: The structure is more important than the amount of pessimism


113. AnyGroundBench: A Specialized-Domain Benchmark for Video Grounding in Vision-Language Models


114. HERMES: A Multi-Granularity Labeling Substrate for Pre-training Data Mixtures


115. Challenges and Recommendations for LLMs-as-a-Judge in Multilingual Settings and Low-Resource Languages


116. Efficient Waste Sorting for Circular Economy: A Confidence-guided comparison between One-Vs-All and One-Vs-Rest Classification Strategies with Human-in-the-Loop for Automated Waste Sorting


117. CoFL-S: Spatially Queryable Sector Flow Fields for Local Language-Conditioned Navigation


118. The Eticas AI Risk Taxonomy: Open Infrastructure for Operationalizing AI Audits


119. What Types of Human-AI Teams Exist?


120. Overview of Risk Assessment and Management for Intelligent Systems under the AI Act and Beyond


121. RadiomicNet: A Hybrid Radiomics-Guided Lightweight Architecture for Interpretable Medical Image Segmentation


122. Dynamic Neural Graph Encoding of Inference Processes in Deep Weight Space


123. Predicting Early Stages Of Alzheimer’s Disease And Identifying Key Biomarkers Using Deep Artificial Neural Network And Ensemble Of Machine Learning Methodologies


124. ART for Diffusion Sampling: Continuous-Time Control and Actor-Critic Learning


125. Behind the Refusal: Determining Guardrail Activation via Behavioral Monitoring


126. An Efficient vLLM-Based Inference Pipeline for Unified Audio Understanding and Generation


127. Guided Action Flow: Q-Guided Inference for Flow-Matching Vision-Language-Action Policies


128. ESC: Emotional Self-Correction for Reliable Vision-Language Models


129. Evolutionary Wave Function Collapse


130. kNNGuard: Turning LLM Hidden Activations into a Training-Free Configurable Guardrail


131. SA-HGNN: Sample-Adaptive Hyperbolic Graph Neural Network for EEG-Based Depression Recognition


132. Prompt Coverage Adequacy


133. Beyond the Performance Illusion: Structure-Aware Stratified Partitioning and Curriculum Distributionally Robust Optimization for Spatially Correlated Domains


134. SPLIT: Cross-Lingual Empathy and Cultural Grounding in English and Ukrainian LLM Responses


135. OpenSafeIntent: Evaluating Intent-Calibrated Safe Completion Across Dual-Use Prompt Sets


136. Towards Load-Aware Prefill Deflection for Disaggregated LLM Serving


137. Mirror Illusion Art


138. Do Newer Lightweight CNNs Perform Better Under Resource Constraints? A Controlled Multigenerational Study of Architecture, Initialization, Training Budget, and Efficiency


139. MolSight: A Graph-Aware Vision-Language Model for Unified Chemical Image Understanding


140. A Multi-Branch Hierarchy-Aware Framework for Heterogeneous Audio Classification


141. Assessing VLM Reliability for Medical Image Quality Evaluation Under Corruption and Bias


142. Object Aligner: A Configurable JSON Schema Similarity Score for Graphs, Applied to LLM Prompt Optimization


143. NeoMap: Training-free Novel-View Synthesis from Single Images and Videos


144. Robust for the Wrong Reasons: The Representational Geometry of LLM Robustness to Science Skepticism


145. Conditional Co-Ablation: Recovering Self-Repair Backups in Transformer Circuits


146. PhysMani: Physics-principled 3D World Model for Dynamic Object Manipulation


147. CausalSteward: An Agentic Divide-Conquer-Combine Copilot for Causal Discovery


148. AIriskEval-edu: New Dataset for Risk Assessment in AI-mediated K-12 Educational Explanations


149. TUDUM: A Turkish-Thinking Reasoning Pipeline for Qwen3.5-27B


150. Low-Latency Task-Oriented Image Transmission with Opportunistic Spectrum Access


151. Population-Based Multi-Objective Training of Discriminators for Semi-Supervised GANs


152. SABER: A Semantic-Aligned Brain Network Analysis Framework via Multi-scale Hypergraphs


153. Rank-Then-Act: Reward-Free Control from Frame-Order Progress


154. SAB-LVLM: Significance-Aware Binarization for Large Vision-Language Models


155. An Exploratory Study on LLM-Generated Code and Comments in Code Repositories


156. Has This Checkpoint Been Abliterated? A Two-Signal Audit and Its Failure Map


157. Evaluating Chunking Strategies for Retrieval-Augmented Generation on Academic Texts


158. Decomposer: Learning to Decompile Symbolic Music to Programs


159. Mixture-of-Parallelisms: Towards Memory-Efficient Training Stack for Mixture-of-Experts Models


160. MMBench-Live: A Continuously Evolving Benchmark for Multimodal Models


161. Decoupling Code Complexity from Newcomer Participation: A Causal Study of AI Coding Agent Adoption in OSS


162. Expander Sparse Autoencoders: Parameter-Efficient Dictionaries for Mechanistic Interpretability


163. Single-Channel EEG-Based Cognitive Load Assessment in Online Learning: A Hybrid Deep Learning Approach


164. Lightweight Safe Reinforcement Learning for End-to-End UAV Navigation


165. EPnG: Adaptive Expert Prune-and-Grow for Parameter-Efficient MoE Fine-tuning


166. Scene-Conditioned PINN-GNN for Multipath RF Maps: Cross-Scene Generation and In-Scene Completion


167. AI Virtue: What is “Good” Knowledge in the Age of Artificial Intelligence?


168. ProCal: Inference-Time Proposal Calibration for Open-Vocabulary Object Detection


169. Decentralized Stochastic Subgradient-type Methods with Communication Compression for Nonsmooth Nonconvex Optimization


170. MedStreamBench: A Time-Aware Benchmark for Streaming and Proactive Medical Video Understanding


171. Full Bayesian Reinforcement Learning via LF-IBIS


172. Predicting Closed-Loop Performance of Latent World Models: Offline Checkpoint Selection for MPC and Model-Based RL Under Non-Markovian Rewards in LunarLander


173. Pmeta-TLA: Backdoor Attacks for Speech Classification Models via Meta-Learning with Timbre Leakage Attack


174. Model Merging as Probabilistic Inference in Fine-Tuning Parameter Space


175. Beyond Gradient-Based Attacks: Adversarial Robustness and Explainability Stability in Cybersecurity Classifiers


176. AgenticDataBench: A Comprehensive Benchmark for Data Agents


177. MKGR: Multimodal Knowledge-Graph Representation Learning for Cold-Start Protein-Protein Interaction Prediction


178. VLAFlow: A Unified Training Framework for Vision-Language-Action Models via Co-training and Future Latent Alignment


179. ADVENT: LLM-Driven Automatic Predicate Invention for ILP


180. DiPS: Dialogue Policy Selection for High-Stakes Persuasion Agents


181. X-LogSMask: Expand Transformer for Graph-Structured Data


182. Evolutionary Feature Engineering for Structured Data



184. Multi-Head Recurrent Memory Agents


185. Robust and Explainable 3D Mode Shape Recognition Using Region-Aware Graph Neural Networks


186. Don’t Let Gains FADE: Breaking Down Policy Gradient Weights in RL


187. Fully Unsupervised Detection of Physical Contacts on Subsea Cables via State-of-Polarization Monitoring


188. Grounded Optimization: A Layered Engineering Framework for Reducing LLM Hallucination in Automated Personal Document Rewriting


189. Token Geometry


190. On the Utility and Factual Reliability of Pruned Mixture-of-Experts Models in the Biomedical Domain


191. IsoSci: A Benchmark of Isomorphic Cross-Domain Science Problems for Evaluating Reasoning versus Knowledge Retrieval in LLMs


192. Risk Architecture for AI-Native Engineering Teams: An Organizational Framework for Agentic System Governance


193. MultAttnAttrib: Training-Free Multimodal Attribution in Long Document Question Answering


194. Adoption and Impact of Command-Line AI Coding Agents: A Study of Microsoft’s Early 2026 Rollout of Claude Code and GitHub Copilot CLI


195. GPUAlert: A Zero-Instrumentation Process-Boundary Monitor for Diagnosing GPU Training-Job Failures


196. Spin-Weighted Spherical Harmonics Enable Complete and Scalable $\mathrm{E}(3)$-Equivariant Networks


197. NeuroBridge: Bridging Multi-Task MRI Knowledge for Neurodegenerative Disease Diagnosis


198. Rethinking Generic Object Tracking Toward Human-Level Perceptual Intelligence


199. How Should Transformers Encode Numeric Values in Electronic Health Records?


200. AI-enabled gravitational-waves searches for binary neutron stars at optimal sensitivity


201. Multi-modal Rail Crossing Safety Analysis


202. TurnNat: Automatic Evaluation of Turn-Taking Naturalness in Dyadic Spoken Dialogue


203. Mechanistic Interpretability and Causal Feature Steering of Neural Quantum States via Sparse Autoencoders


204. Black-Box Inference of LLM Architectural Properties with Restrictive API Access


205. Generative AI and Federated Learning for Intrusion Detection Systems: A Survey


206. CPG-PAD: Concept-Informed Prompts Guided Presentation Attack Detection


207. Adaptive Companionship for Group-Following Robots: Handling Dynamically Changing Group Formations


208. Scaling Laws for Grid-Based Approximate Nearest Neighbor Search in High Dimensions


209. Domain Knowledge Based Temporal-Spatial Graph Convolution Network for ECG Recognition


210. Benchmarking Federated Learning and Knowledge Distillation for Point Cloud Classification


211. The Rising Unsustainability of AI Graphics Cards Production


212. Artificial Intelligence-Enabled Accounting Information Systems and Fraud Detection in Nigeria’s Financial Services Sector: The Moderating Role of Natural Language Processing


213. AI Assistance for Human Review of Default Judgments


214. Beyond Detection: Redesigning Assessment and Governande of Generative AI at the Universidad Politécnica de Madrid (UPM)


215. How Indian Dermatologists are Utilizing Artificial Intelligence for Clinical Practice and Workflow Management: A Nationwide Survey with a Special Focus on atopic dermatitis


216. Collaborative Disagreement Resolution for Scalable Oversight


217. Structuring the Space of Sociotechnical Alignment


218. A Practice Auditing Framework for Large Language Model Use: Collective Empiricism, Pseudo-Rational Cognition, and Governance of AI-Generated Content


219. LLMs as Teaching Assistants for Mathematics Exam Grading: Reliability, and Practical Usability


220. Office Comprehension Benchmark


221. ExPerT: Personalizing LLM Responses to Users’ Domain Expertise via Query-Wise Semantic and Keystroke Behavioral Cues


222. Mapping Text to Multiplex Graph: Prompt Compression as Lévy Walk-Guided Graph Pruning


223. Prompt Framing Distorts Count-Based Evaluation of LLM Error Detection: Evidence from Numeric Anchoring


224. Breaking Safety at the Token Boundary: How BPE Tokenization Creates Exploitable Gaps in LLM Alignment


225. SPARCLE: SPeaker-aware Aligned Representations via Contrastive Language Embeddings


226. Kara: Efficient Reasoning LLM Serving via Sliding-Window KV Cache Compression


227. Safeguarding LLM Agents from Misalignment through Provenance Analysis


228. TokenScope: Token-Level Explainability and Interpretability for Code-Oriented Tasks in Large Language Models