전체 AI 논문 - 2026-07-13

1. ConceptSMILE: Auditing the Trustworthiness of Concept-Based Explainable AI


2. Agora: Enhancing LLM Agent Reasoning Via Auction-Based Task Allocation


3. TrustX Agent Risk Classification Framework (ARC): Risk-Tiering Internally Created Agentic AI Systems


4. Knowledge Graphs and Explainable AI as Complementary Resources for Urban Mining


5. Beyond Fixed Representations: The Vocabulary and Verifier Gaps in Open-Ended AI


6. SAGEAgent: A Self-Evolving Agent for Cost-Aware Modality Acquisition in Multimodal Survival Prediction


7. Shared Selective Persistent Memory for Agentic LLM Systems


8. Multimodal Reward Hacking in Reinforcement Learning


9. Ceci n’est pas une pipe: AI systems as semantic abstractions


10. ProofCouncil: An LLM Agent for Solving Open Mathematical Problems


11. How Does Bayesian Causal Discovery Fail? Characterising Structural Consequences in Linear Gaussian Networks under Latent Confounding


12. Fictional Worldbuilding: Multi-Agent LLM Collaboration with Hierarchical Context Compression and Iterative Review


13. Communication-Efficient Digital-Twin Coordination for Heterogeneous LLM Embodied Agents over Computing Power Networks


14. LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making


15. OpenProver: Agentic and Interactive Theorem Proving with Lean 4


16. Toward Auditable AI Scientists: A Hypothesis Evolution Protocol for LLM Agents


17. Scoped Verification for Reliable Long-Horizon Agentic Context Evolution under Distribution Shift


18. KV-PRM: Efficient Process Reward Modeling via KV-Cache Transfer for Multi-Agent Test-Time Scaling


19. MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation



21. Neuro-Agentic Control: A Deep Learning-based LLM-Powered Agentic AI Framework for Controlling Security Controls


22. ARCANA: A Reflective Multi-Agent Program Synthesis Framework for ARC-AGI-2 Reasoning


23. A Formalization of the Mean-Field Derivation of the Vlasov Equation: AI-Assisted Lean Formalization as a Strategy Game


24. Long-Horizon-Terminal-Bench: Testing the Limits of Agents on Long-Horizon Terminal Tasks with Dense Reward-Based Grading


25. GATS: Graph-Augmented Tree Search with Layered World Models for Efficient Agent Planning


26. CogniConsole: Externalizing Inference-Time Control as a Formal Abstraction for Reliable LLM Interactions


27. Interval Certifications for Multilayered Perceptrons via Lattice Traversal


28. PHINN-EEG: Topological Time-Series Analysis of Dream-State EEG – Dynamic Betti Curves for Dream Content Classification and Topology-Conditioned Neural Signal Synthesis


29. Scalable Visual Pretraining for Language Intelligence


30. Evolution of Accuracy and Visual-Cognitive Errors in a Decade of Vision-Language AI Models


31. VEXAIoT: Autonomous IoT Vulnerability EXploitation using AI Agents


32. Semantic Pareto-DQN: A Multi-Objective Reinforcement Learning Framework for Financial Anomaly Detection


33. Lean-QIT: Towards a Formal Infrastructure for Quantum Information Theory


34. 4DR360: State Reasoning for Joint 3D Detection and Occupancy Prediction in 4D Radar-Camera Full-Scene Perception


35. Task-Specific Multimodal Question Answering Agents via Confidence Calibration and Incremental Reasoning for QANTA 2026


36. PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers


37. Conceptual Networks for Cross-Linguistic Idiomatic Expressions:A Feature-Based Graph Approach


38. Large-Scale Portfolio Optimization Problem Under Cardinality Constraint With Enhanced Multi-Objective Evolutionary Algorithms


39. TCLA: Training-Free Class-wise Logit Adaptation for Medical Vision-Language Models


40. ALICE: Learning a General-Purpose Pathology Foundation Model from Vision, Vision-Language, and Slide-Level Experts


41. Seeing is Free, Speaking is Not: Uncovering the True Energy Bottleneck in Edge VLM Inference


42. Failure as a Process: An Anatomy of CLI Coding Agent Trajectories


43. What VGGT Knows About Overlap: Probing Geometric Foundation Models for Co-Visibility


44. All Explanations are Wrong, But Many Are Useful: Exploring the Rashomon Explanation Set with Large Language Models


45. Decoupling Language Guidance from Backbones for Text-Guided Medical Segmentation


46. Practical Source Code Recovery from Binary Functions Using Anchor-Based Retrieval and LLM Reasoning


47. Parameter-Efficient Vision-Language Adaptation with Continuous Metadata Conditioning for Animal Re-Identification


48. Test-Time Scaling for Small VLMs on Multilingual Visual MCQ


49. A Sovereign, Open-Source Foundation Model for German and English


50. SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesitancy Recognition


51. Self-Guided Test-Time Training for Long-Context LLMs


52. On-Device Adaptive Battery Power Prediction for Electric Vehicles


53. Fully Trainable Deep Differentiable Logic Gate Networks and Lookup Table Networks


54. STEEL: Sparsity-Aware Fused Attention for Energy-Efficient Long-Sequence Inference on AMD’s XDNA NPU


55. When Routes Run Out: Adversarial Co-Learning and Explainable Robustness in Quantum Repeater Networks


56. Diversifying to Verify: When Task-Equivalent Programs Differ in Verifiability


57. CtrlVTON: Controllable Virtual Try-On via Visual-Instance-Prompt Segmentation


58. Deceptive Grounding: Entity Attribution Failure in Clinical Retrieval-Augmented Generation


59. Shortcut Trajectory Planning for Efficient Offline Reinforcement Learning


60. WILDTRACE: Benchmarking Natural Evidence Trails in Long-Context Reasoning


61. Letting the Data Speak: Extracting Keywords from Crowdsourced Collections with AI


62. Automatic Thematic Indexing of Large Literary Corpora: A Machine Learning Approach to Voltaire’s Complete Works


63. Creativity, honesty and designed forgetting emerge in small hyperbolic language models


64. Risk-Aware General-Utility Markov Decision Processes


65. Geopolitical alignment: Endorsement effects in large language models


66. Blockchain-Linked Auditable Decision Management for Telecom/IoT Fraud-Control Requests


67. LLMs for health: Perceived benefits, risks, intention to use AI chatbots, and willingness to self-disclose across sensitive health topics


68. All you need is SAMPAT


69. Git-Assistant: Planning-Based Support for Updating Git Repositories


70. Tactile and Vision Conditioned Contact-Centric Control for Whole-Arm Manipulation


71. Interference and Retention in Continual Learning



73. Attention to Detail: Evaluating Energy, Performance, and Accuracy Trade-offs Across vLLM Configurations


74. A Personalized Computational Framework for Assessing the Sufficiency of Partially Observed Data in Healthcare AI models


75. ReGen: Hierarchical Multi-Prompt Representation Generation for Efficient Waveform Diffusion Models


76. IB-Flow: Information Bottleneck-Guided CFG Distillation for Few-Step Text-to-Image Generation


77. Augmenting Fundamental Analysis with Large Language Models: A RAG-Based System for Generating Investor Briefs


78. Event Stream based Multi-Modal Video Anomaly Detection: A Benchmark Dataset and Algorithms


79. Integrating Large Language Models and Graph Convolutional Networks for Semi-Supervised Image Classification


80. Beyond Metadata: CAPRA for Hidden Subgroup Analysis under Missing Metadata in Medical Imaging


81. A Coreset Selection Framework with Ensemble Aggregation for Image Classification



83. OmniMapBench: Benchmarking Visual-Centric Reasoning on Diverse Map Documents


84. Inside the Skill Market: From Software Engineering Activities to Reusable Agent Skills


85. On Locality and Length Generalization in Visual Reasoning


86. Quantum Logic as the Logic of Contexts


87. Evolutionary Intelligence for Scientific Discovery: From Evolutionary Computation to Cumulative Discovery Systems


88. Video Generation Models are General-Purpose Vision Learners


89. Phone Segmentation and Recognition through Phonological Activation Mapping


90. Correlation-Aware Contextual Bandits with Surrogate Rewards for LLM Routing


91. Model Agnostic Graph Prompt Learning for Crystal Property Prediction


92. AlphaZero in Sparsely Rewarded Games: Limits and Auxiliary Supervision


93. SCATE: Learning to Supervise Coding Agents for Cost-Effective Test Generation


94. The Patchwork Problem in LLM-Generated Code


95. CLAP: Direct VLM-to-VLA Adaptation via Language-Action Grounding


96. MultiView-Bench: A Diagnostic Benchmark for World-Centric Multi-View Integration in VLMs


97. NL-PAC: Specification Ambiguity and Certified Minimax Risk Floors in LLM-Mediated Supervision


98. Eluna: An Agentic LLM System for Automating Warehouse Operations with Reasoning and Task Execution


99. A Novel Parallel QCNN Architecture with Efficient Classical Simulability


100. Prompt-Driven Exploration


101. TheBioCollection: Unified Pre-Training Scale LLM Corpus for Biology


102. Multi-Conditioned Diffusion Synthesis of Sand Boils for Low-Resource Earthen-Levee Inspection


103. EHR-MPC: Inference-Time Control for Sepsis Treatment with Generative Patient Digital Twins


104. LLM-Driven Evolutionary Generation of Multi-Objective Bayesian Optimization Algorithms


105. Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices


106. DaDaDa: A Dataset for Data Pricing in Data Marketplaces


107. HERO: A Heterogeneity-Aware Benchmark Library for Federated Continual Learning


108. LieBN: Batch Normalization over Lie Groups


109. Director: Accelerating Distributed MoE Serving via Online Proactive Expert Placement


110. Reward Transport: Property Control in Flow Matching via Noise-Space Alignment


111. Sticky Routing: Training MoE Models for Memory-Efficient Inference


112. Signed Symmetric Quantization for Few-Bit Integers


113. iLENS: Interpretable LLM-Guided Mixture-of-Experts for Neuroimaging Survival Analysis


114. A Unified Approach to Interpreting Knowledge Distillation for Large Language Models via Interactions


115. REFORGE: A Method for Benchmarking LLMs’ Reverse Engineering Capabilities in Decompiled Binary Function Naming


116. Minimal Decision Dynamics and Contextual Probability: A Quantum Tug-of-War Model