전체 AI 논문 - 2026-07-08

1. Rethinking Indic AI from a Lens of Cultural Heritage Preservation


2. The Large Cancer Assistant (LCA): A Model-Agnostic Orchestration Framework for Scalable Clinical Decision Support in Oncology


3. DepthWeave-KV: Token-Adaptive Cross-Layer Residual Factorization for Long-Context KV Cache Compression


4. Bridging Physical Reasoning and Task Generalization via Visual Action Outcome Reasoning Alignment


5. FreqDepthKV: Frequency-Guided Depth Sharing for Robust KV Cache Compression in Long-Context LLM Inference


6. FootsiesGym: A Fighting Game Benchmark for Two-Player Zero-Sum Imperfect-Information Games


7. RMISC: A Large-scale Real-world Multivariate Corpus for Time Series Foundation Models


8. Doomed from the Start: Early Abort of LLM Agent Episodes via a Recall-Controlled Probe Cascade


9. Multi-Agent Deep Reinforcement Learning for Multi Objective Battery Management in Dairy Farms


10. A Physics-Informed Neural Network Framework for Elastodynamic Wave Propagation in Bimaterial Systems


11. Danus: Orchestrating Mathematical Reasoning Agents with Fact-Graph Memory


12. Finding H. pylori in the Fine Print: Evidence-Linked Multi-Agent Case Finding from Gastric Biopsy Reports


13. ExplAIner: A Declarative Query Language for Explaining Classification Models


14. A Definition and Roadmap for World Models


15. TopoBrick: Agentic Topology Sampling of Exogenous Variables for Zero-Shot Building IoT Forecasting


16. Driving the Wrong Way: Leveraging Interpretability in End2End Autonomous Driving Models


17. DT-Guard: Intent-Driven Reasoning-Active Training for Reasoning-Free LLM Safety Guardrail


18. Task Decomposition-Guided Reranking for Adaptive Agent Skill Retrieval


19. From Application-Layer Simulation to Native Meta-Architecture: Structural Tension as an Endogenous Driver for Heterogeneous AI Evolution


20. Demonstrating TOFFEE: A Learned System for Synthesizing Data Agent Trajectories at Scale


21. Information Gain-based Rollout Policy Optimization: An Adaptive Tree-Structured Rollout Approach for Multi-Turn LLM Agents


22. A toy framework for single and multi-agent human-AI curiosity ecosystems


23. When do prophets profit in prediction markets?


24. Reward-Density Heuristic for Dynamic Multi-Vehicle Routing: Performance and Computational Efficiency


25. PolyWorkBench: Benchmarking Multilingual Long-Horizon LLM Agents


26. Information Limits and Attractor Dynamics in Economies of Frontier LLM Agents: A Pre-Registered Test


27. AgoraSim: A Hybrid Agent-Based Modeling Framework


28. Auto-DSM Under the Lens: A Black-Box Evaluation Framework for LLM-Based DSM Generation


29. Integrating knowledge graphs and multilingual scholarly corpora for domain-adaptive LLMs in SSH


30. SearchEyes: Towards Frontier Multimodal Deep Search Intelligence via Search World Simulation


31. PCBWorld: A Benchmark Environment for Engine-Grounded PCB Design Automation


32. Uncovering Latent Depression Severity for Binary Depression Detection via Advantage-weighting Ranking


33. StateFuse: Deterministic Conflict-Preserving Memory for Multi-Agent Systems


34. Onnes: A Physics-Grounded Multi-Agent LLM Simulator for Cryogenic Fault Diagnosis in Quantum Computing Infrastructure


35. TurnOPD: Making On-Policy Distillation Turn-Aware for Efficient Long-Horizon Agent Training


36. From Passive Retrieval to Active Memory Navigation: Learning to Use Memory as a Structured Action Space


37. Controlling Tool Use with Heading-Specific Activation Steering


38. Beyond the Leaderboard: A Synthesis of Tool-Use, Planning, and Reasoning Failures in Large Language Model Agents


39. Beyond Static Evaluation: Building Simulation Environments for Scalable Agentic Reinforcement Learning


40. Synthetic Consumer Insight Generation with Large Language Models


41. ArtisanCAD: An Industrial-Level CAD Agent with Expert-Grounded Knowledge Distillation


42. Akashic: A Low-Overhead LLM Inference Service with MemAttention


43. Memory in the Loop: In-Process Retrieval as ExtendedWorking Memory for Language Agents


44. FirstResearch: Auditable Question Formation for LLM Scientific Discovery Agents


45. Narrative World Model: Narratology-Grounded Writer Memory for Long-Form Fiction


46. Foundation Models for Automatic CAD Generation


47. CSTutorBench: Benchmarking Small Language Models as Tutors for Block-Based Programming


48. From Graphs to Gradients: Physics-Inspired Structural Attribution for Cyber-Physical IoT Systems and Beyond


49. Prompt-to-Paper: Agentic AI System for Bioinformatics


50. ELSA3D: Elastic Semantic Anchoring for Unified 3D Understanding and Generation


51. Graph Convolutional Attention: A Spectral Perspective on Graph Denoising and Diffusion


52. RSF-GLLM: Bridging the Semantic Gap in Multi-Hop Knowledge Graph QA via Recurrent Soft-Flow and Decoupled LLM Generation


53. Industry Classification of GitHub Repositories Using the North American Industry Classification System (NAICS)


54. Pitwall: Faithful Natural-Language Race-Strategy Briefings from a Calibrated Real-Time Monte Carlo Engine


55. AirflowAttack: Thermal-Airflow Adversarial Perturbations against Infrared Remote-Sensing Vision-Language Models


56. Data Analysis in the Wild: Benchmarking Large Language Models Against Real-World Data Complexities


57. Prompt-Adapter Context Routing for Parameter-Efficient Multi-Shot Long Video Extrapolation


58. Provable learning separation for predicting time-evolution of quantum many-body systems


59. From Voting to Agent Collaboration: Answer-Type-Aware LLM Pipelines for BioASQ 14b


60. Analysis-by-Proxy: Localization Signals in VLMs Operating as Condition Encoders


61. TILDE: TILt-based Distributional Erasure for Concept Unlearning


62. An Experimental Design Approach to Evaluating Agentic AI’s Autonomous Model Discovery


63. RuBench: A Repository-Level Agentic Coding Benchmark with Natively Authored Russian Task Specifications


64. What Images Cannot Say: Language-Guided Olfactory Representation Learning


65. Responsible Personalisation: The Double-Edged Sword of Personalisation in Human-Robot Interaction


66. Harnessing Code Agents for Automatic Software Verification


67. Estimating Uncertainty from Reasoning: A Large-Scale Study of Multi- and Crosslingual MCQA Performance in LLMs


68. Token-Based Dual-view Fusion and Adaptation of Large Vision Models for Breast Cancer Classification


69. UI2App: Benchmarking Visual Interaction Inference in Executable Web Application Generation


70. Designing Maintainable Hybrid Generative Systems: A Quantum-Inspired Approach to Automated Music Harmony Generation


71. VendorBench-100: A Unified Cross-Paradigm Benchmark for Deepfake Image Detection


72. Spider 2.0-AIFunc: Extending Real-World Text-to-SQL to AI-Native SQL Workflows


73. UBEP: Re-architecting Expert Parallelism Communication Library for Production Superpods


74. TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios


75. Improving LLM-Generated Process Model Quality Through Reinforcement Learning: The Role of Reward Function Design


76. X-FEMR: A Token-level Explainable Approach for Electronic Health Records Foundation Models using Transformer-based Models


77. LongCrafter: Towards Diverse Long-Context Understanding via Evidence-Graph-Guided Instruction Synthesis


78. LLM Agents for Deliberative Collaboration: A Study on Joint Decision Making Under Partial Observability


79. Property-Driven Synthetic Data Engineering for Data-Scarce Software Systems: Reflections from the Breast Cancer Domain


80. Self-Supervised Implicit CEST Reconstruction via Physics-Informed Lorentz Encoding


81. Evaluating Fine-Tuning and Metrics for Neural Decompilation of Dart AOT Binaries


82. Static Metrics Are Insufficient: Predicting Java Method Energy Usage with Execution Time


83. x-Prediction Is All You Need:Training-Free Accelerated Generation via Endpoint Decodability


84. LLM-Guided Measurement Credibility Correction for Trustworthy Industrial Process Inference


85. RoME: Robust Mixture of Low-Rank Experts against Multiple Adversarial Perturbations


86. EcoVision: AI-Powered Drone Imaging for Salt Marsh Vegetation Monitoring and Dominance Mapping


87. Agents That Teach: Towards Designing Incidental Learning Back into AI-Assisted Software Development


88. PVCap: Towards Accurate 3D Dense Captioning via PseudoCap and VoxelCapNet


89. From Blueprint to Reality: Modeling and Applying Putnam’s Social Capital Theory with LLM-based Multi-agent Simulations


90. Prompt Coach: An Empirical Evaluation of an Agentic Tutor for Learning Prompt Engineering in Software Development


91. PluraMath: Extending Mathematical Reasoning Evaluation Beyond High-Resource Languages


92. Propose and Attend: Training-free MLLM Grounding Confidence via Multi-Token Localized Attention


93. MCP-Enabled Agentic AI for Autonomous IPoDWDM Network Lifecycle Automation



95. InfluMatch: Frontier-Quality KOL Search at 4B-Model Cost


96. Decoupled Single-Mask Annotation Noise Detection via Cross-Sectional Patch Self-Consistency


97. Agentic AI for IPoDWDM Network Lifecycle Automation: An MCP-Enabled Architecture


98. NegROI: Click-Centric Uncertainty-Guided Refinement with Scene-Conditioned Negative Prompts for Robust Interactive 3D Segmentation


99. Signed-Graph Recommendation as Structural Consistency Maximization


100. CMDR: Contextual Multimodal Document Retrieval


101. PolicyShiftGuard: Benchmarking and Improving Policy-Adaptive Image Guardrails


102. K-ABENA: K-Adaptive Backpropagation with Error-based N-exclusion Algorithm : (Compensated Loss-Based Sample Exclusion with Unbiased Gradient Estimation)


103. From Textural Counterpoint to Feature Encoding: A Multi-Dimensional Machine Representation Study of Haydn’s “The Lark” Integrating Electroacoustic Analysis


104. Few-Medoids: An Embarrassingly Simple Coreset Selection Method for Few-Shot Knowledge Distillation


105. i-EXAM: Instructable and Explainable Attack Connectivity Graph Modeler


106. Harrison.Rad 1.5 Technical Report: A radiology foundation model that can draft reports from images, priors and clinical context


107. Think Before You Grid-Search: Floor-First Triage for LLM Serving


108. Differentially Private Natural Gradient Descent


109. Unsupervised Anomaly Detection of Information Operations Users via Behavioral and Language Patterns


110. AbICL: In-Context Learning for Antigen-Specific Antibody Affinity Ranking


111. Beyond Refusal: A Same-Lineage Study of Aligned and Abliterated LLMs for Vulnerability Analysis


112. VisTCP: A Visualization Framework to Construct Knowledge-Graph-Based Representation for Traditional Chinese Painting


113. Tangent classes of matroids and wonderful compactifications


114. Decision-Focused Scenario Generation and Selection for Efficient and Robust Grid Dispatch


115. Complementary Roles of Image Classification and Vessel Segmentation in AI-Based Screening for Retinopathy of Prematurity Plus Disease in a Kenyan Preterm Cohort


116. Segmentation before Answering: Pixel Grounding for MLLM Visual Reasoning


117. FORGE: Towards Functional Tool-Use Generalization via Keypoint Trajectory Reasoning


118. LEGATO 2: Toward Multimodal Sheet Music Recognition and Understanding


119. Data-dependent Evaluations for Budgeted Submodular Maximization


120. When Should LLMs Search? Counterfactual Supervision for Search Routing


121. Unicode TAG-Block Concealment of Tool-Metadata Payloads in the Model Context Protocol: An Approval-View Fidelity Gap Across Three Independent Server Implementations


122. The Balkanization of Execution-Security Research for AI Coding Agents: Isolation, Access Control, and Time-of-Check-to-Time-of-Use Vulnerabilities


123. SCOReD: Student-Aware CoT Optimization for Recommendation Distillation


124. Plainbook: Data Science, in Plain Language


125. IMR: Iterative Mode-World Weighted Regression for Multi-Agent Trajectory Prediction


126. Depression Symptoms and Relational Patterns in 187k ChatGPT Histories



128. RPAM: A Principled Metric for Evaluating Associations in Language Models with High Predictive Validity in Downstream Outputs


129. What Do AI Agents Actually Change? An Empirical Taxonomy of Mutation Patterns in Performance-Improving Pull Requests


130. Physics-Regularized Machine Learning for Proprioceptive Vehicle Localization Using Onboard Sensors


131. Do It Right! A Methodology for Successful NLP System Development


132. EvalLoop: A Methodology for Evaluation-Driven Iterative Improvement of Business AI Systems


133. Safe Bayesian Optimization with Counterfactual Policies


134. BaFCo: A Document Understanding Benchmark for Complex Bangla Form Comprehension


135. To Retain or to Adapt? Generalizing Continual Learning


136. Hierarchical Classification via Cascading Feature Elimination: Application to Human Phenotype Ontology-Aligned Facial Phenotyping (FaceMesh2HPO)


137. ResonatorLM: Causal Resonant Field Mixing for Efficient Long-Context Language Modelin


138. Whose fairness? Structural concentration in AI bias research


139. Harnessing Generative Image Models for Training-Free Primitive Shape Abstraction


140. Prompt Robustness Is Task-Dependent: Comparing Objective and Belief-Style Questions in LLM Evaluation


141. The yes-no bias of large language models reflects answer order and wording, not shifts in moral judgment


142. Most LLM Conformity Needs No Speaker: Measuring the Speaker-Free Floor in Peer-Pressure Benchmarks


143. Self-Review Reinforcement Learning (SRRL) with Cross-Episode Memory and Policy Distillation


144. Rendering-Aware Bayesian 3D Gaussian Splatting with Native Uncertainty and Adaptive Complexity Control


145. aiAuthZ: Off-Host, Identity-Bound Authorization for AI Agents


146. Statistical Adversaries: Natural Backdoor-like Features in Vision Datasets


147. Lean-Quantum: Toward AI-Assisted Formalization of Quantum Information


148. PatchOptic for Shared-State LLM Workflows with Projected Views and Verified Structured Updates


149. Full-range Binary Classifier Calibration for Stable Model Updates in Production


150. Privilege and confidentiality in generative AI workflows


151. Decision Protocols in Multi-Agent Large Language Model Conversations


152. Is Your NPU Ready for LLMs? Dissecting the Hidden Efficiency Bottlenecks in Mobile LLM Inference


153. Binocular Gaze Estimation with Single Camera and Single Light Source


154. KAT-Coder-V2.5 Technical Report


155. Breaking Structural Isolation: Scalable Graph Clustering via Community-Aware Sampling and Structural Entropy


156. Learning 4D Geometric Priors for Inference-Efficient World Action Models


157. CanvasAgent: Enabling Complex Image Creation and Editing via Visual Tool Orchestration


158. Learnable Weighting of Intra-Attribute Distances for Categorical Data Clustering with Nominal and Ordinal Attributes


159. Evaluating calibrated refusal and safe usefulness in dual-use biology settings


160. AdaStop: Cost-Aware Early Stopping for DNN Test Selection


161. Learning to Control LLM Agent Harnesses with Offline Reinforcement Learning


162. Empirical Minimal-Realisation Compression of Deep Neural Networks via Controllability-Observability Tests


163. The Granularity Paradox: How Temporal Disaggregation Inflates In-Sample Fit and Compounds Out-of-Sample Error


164. Geometry-Aware Infrastructure-Anchored Denoiser for UWB Sensing and Work-Zone Reconstruction


165. Scientific Code Search at Scale: A Multi-Domain Dataset and Benchmark


166. PORTS: Preference-Optimized Retrievers for Tool Selection with Large Language Models


167. Modality Relevance is not Modality Utility: Post-hoc Selective Modality Escalation for Cost-Aware Multimodal RAG


168. CHARLIE: An On-Premise Multi-Agent Retrieval-Augmented Generation System for Evidential Reasoning in Forensic Science


169. When AI Classifies: What Counts as Public Administration?


170. Contrastive Predictive Coding with Compression for Enhanced Channel State Feedback in Wireless Networks



172. The GenAI Skill Bypass: Mapping Divergent Pathways of University Students and Staff AI Literacy


173. CANONIC: Governance Is Compilation


174. Automated Recommendation of Programming Learning Content Using Pattern-based Knowledge Components


175. Position: Preventing AI-Generated CSAM Necessitates New Approaches to AI Safety


176. A Guiding Framework for K-12 Teachers in Creating AI-powered Learning Technologies through Vibe Coding


177. CCBENCH: Assessing LLM Cultural Competence via Implicitly Signaled Norms using Health Queries


178. The Jagged Global Economy: Frontier AI Unevenly Exposes National Economies


179. AI tools in Arab University English classrooms: Looking back and forward


180. Catalyst Papers in Artificial Intelligence Research: A Landscape on ICLR from 2017 to 2025


181. Benchmarking KV-Cache Optimizations across Task Quality and System Performance for Long-Context Serving


182. Proof of Execution: Runtime Verification for Governed AI Agent Actions


183. KVpop – Key-Value Cache Compression with Predictive Online Pruning


184. Lingering Authority: Revocable Resource-and-Effect Capabilities for Coding Agents