LLM 관련 주요 논문 - 2026-07-13

1. Agora: Enhancing LLM Agent Reasoning Via Auction-Based Task Allocation


2. SAGEAgent: A Self-Evolving Agent for Cost-Aware Modality Acquisition in Multimodal Survival Prediction


3. Shared Selective Persistent Memory for Agentic LLM Systems


4. Multimodal Reward Hacking in Reinforcement Learning


5. ProofCouncil: An LLM Agent for Solving Open Mathematical Problems


6. Fictional Worldbuilding: Multi-Agent LLM Collaboration with Hierarchical Context Compression and Iterative Review


7. Communication-Efficient Digital-Twin Coordination for Heterogeneous LLM Embodied Agents over Computing Power Networks


8. LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making


9. OpenProver: Agentic and Interactive Theorem Proving with Lean 4


10. Toward Auditable AI Scientists: A Hypothesis Evolution Protocol for LLM Agents


11. Scoped Verification for Reliable Long-Horizon Agentic Context Evolution under Distribution Shift


12. KV-PRM: Efficient Process Reward Modeling via KV-Cache Transfer for Multi-Agent Test-Time Scaling


13. MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation


14. Neuro-Agentic Control: A Deep Learning-based LLM-Powered Agentic AI Framework for Controlling Security Controls


15. GATS: Graph-Augmented Tree Search with Layered World Models for Efficient Agent Planning


16. CogniConsole: Externalizing Inference-Time Control as a Formal Abstraction for Reliable LLM Interactions


17. Scalable Visual Pretraining for Language Intelligence


18. Evolution of Accuracy and Visual-Cognitive Errors in a Decade of Vision-Language AI Models


19. VEXAIoT: Autonomous IoT Vulnerability EXploitation using AI Agents


20. Semantic Pareto-DQN: A Multi-Objective Reinforcement Learning Framework for Financial Anomaly Detection


21. TCLA: Training-Free Class-wise Logit Adaptation for Medical Vision-Language Models


22. Seeing is Free, Speaking is Not: Uncovering the True Energy Bottleneck in Edge VLM Inference


23. Failure as a Process: An Anatomy of CLI Coding Agent Trajectories


24. What VGGT Knows About Overlap: Probing Geometric Foundation Models for Co-Visibility


25. All Explanations are Wrong, But Many Are Useful: Exploring the Rashomon Explanation Set with Large Language Models


26. Practical Source Code Recovery from Binary Functions Using Anchor-Based Retrieval and LLM Reasoning


27. Parameter-Efficient Vision-Language Adaptation with Continuous Metadata Conditioning for Animal Re-Identification


28. Test-Time Scaling for Small VLMs on Multilingual Visual MCQ


29. Self-Guided Test-Time Training for Long-Context LLMs


30. STEEL: Sparsity-Aware Fused Attention for Energy-Efficient Long-Sequence Inference on AMD’s XDNA NPU


31. When Routes Run Out: Adversarial Co-Learning and Explainable Robustness in Quantum Repeater Networks


32. Diversifying to Verify: When Task-Equivalent Programs Differ in Verifiability


33. Automatic Thematic Indexing of Large Literary Corpora: A Machine Learning Approach to Voltaire’s Complete Works


34. Creativity, honesty and designed forgetting emerge in small hyperbolic language models


35. Geopolitical alignment: Endorsement effects in large language models


36. Blockchain-Linked Auditable Decision Management for Telecom/IoT Fraud-Control Requests


37. Git-Assistant: Planning-Based Support for Updating Git Repositories


38. Attention to Detail: Evaluating Energy, Performance, and Accuracy Trade-offs Across vLLM Configurations


39. Augmenting Fundamental Analysis with Large Language Models: A RAG-Based System for Generating Investor Briefs


40. Integrating Large Language Models and Graph Convolutional Networks for Semi-Supervised Image Classification


41. On Locality and Length Generalization in Visual Reasoning


42. Correlation-Aware Contextual Bandits with Surrogate Rewards for LLM Routing


43. The Patchwork Problem in LLM-Generated Code


44. NL-PAC: Specification Ambiguity and Certified Minimax Risk Floors in LLM-Mediated Supervision


45. Eluna: An Agentic LLM System for Automating Warehouse Operations with Reasoning and Task Execution


46. Prompt-Driven Exploration


47. TheBioCollection: Unified Pre-Training Scale LLM Corpus for Biology


48. LLM-Driven Evolutionary Generation of Multi-Objective Bayesian Optimization Algorithms


49. Accelerating GPU Inference of Large Language Models with Moderately Unstructured Sparse Weight Matrices


50. Sticky Routing: Training MoE Models for Memory-Efficient Inference


51. Signed Symmetric Quantization for Few-Bit Integers


52. iLENS: Interpretable LLM-Guided Mixture-of-Experts for Neuroimaging Survival Analysis


53. A Unified Approach to Interpreting Knowledge Distillation for Large Language Models via Interactions


54. REFORGE: A Method for Benchmarking LLMs’ Reverse Engineering Capabilities in Decompiled Binary Function Naming