전체 AI 논문 - 2026-09-11

1. Can Edge-Deployable Vision-Language Models Identify Species?


2. Artificial Id: Drive and Persistent Alignment in Agentic AI


3. MindTopo: Can Foundation Models Reason in Topological Space?


4. On the Regularization Landscape for the Linear Recommendation Models


5. Explainability Assistant: A Conversational XAI Interface for Interpreting Energy Consumption Models


6. From Parameters to Answers: How LLMs Retrieve and Use Their Internal Knowledge


7. A Unified Per-Token Gating Family for On-Policy Distillation: FKL/RKL Mixing with Multi-Channel and Bias Coefficients


8. SIRF: A Spec-Internalized Risk Foundation Model for Industrial Content Risk Control


9. When Agents Disagree: Bayesian Backward Reasoning as a Label-Free Anchor for Multi-Agent Collective Decision-Making


10. COBRA-Skills: Contextual Bandit-Guided Evolution for Agent Skill Optimization


11. Geospatial AI, Dataverse Metadata, and the Study of Place-Based Government


12. Autonomy, Social Norms, and Alignment: Towards a Developmental Framework for Autonomous Artificial Agents


13. MAPLE: Memory-Augmented Planning with Language and Evolution


14. Distributed Optimization of Modular Production Systems using Model-based Reinforcement Learning with Inverse Models


15. Making Alternative Data Work: Context-Augmented LLMs for Financial Forecasting


16. Enabling Knowledge Graph Understanding at Scale with the EXplore Your Graphs ENgine (EXYGEN)


17. Characterizing Job Power Elasticity for Power-Flexible AI Training


18. Prompt Revision as a Source of Cultural Bias in Text-to-Image Systems


19. Lightweight LiDAR-Based Cone Detection Framework Using Random Forest for Formula Student Driverless


20. Extending SMT Solving with Non-Ground Clause Learning


21. ActMap: Single-Pass Uncertainty Quantification from Generation-Time Activation Maps


22. From Document Silos to Process Intelligence: A Multi-Layer Knowledge Graph for CMC Process Development


23. Published Unlearning Numbers Move Per Checkpoint, and Not Because the Removed Data Survives: An Audit of 263 Released Batch-Normalized Checkpoints


24. The Convention Gap: Towards Measuring Implicit Communication in Cooperative AI Evaluation


25. Flexible and Interpretable Accent Distance Measurements


26. RouteRepair: Instance-Level Failure Diagnosis and Targeted Repair in LLM-Based Automated Heuristic Design for Routing Optimization


27. Calibration-Aware Uncertainty Cascades for Efficient Heterogeneous Model Collaboration


28. LLMs as Post-hoc Auditors of Physiological Plausibility in Symbolic Regression: A Clinician-Evaluated Case Study


29. From Queries to Narratives: Cultural Heritage Data Stories for Knowledge Graph Exploration and Quality Assessment


30. Beyond Confidence: Stability-Aware Test-Time Adaptation for LLM Reasoning


31. RAMamba-Net: A Reliability-Aware and Mamba-Based Multimodal Fusion Network for Auditory Attention Detection


32. Portable Semantics, Private Dialects: Reuse and Negative Transfer in Latent Communication Between Language-Model Cells


33. Exploring Diffusion Transformers for Cross-Modal Augmentation in Multimodal Brain State Decoding


34. AI Exposure and AI Resilience: A Two-Dimensional Assessment Framework for Software and Software-Based Business Model


35. Magenta: Closing the Loop Between Mathematical Reasoning and Lean Verification


36. Mr.LHDR: A Benchmark for Multimodal Real-World Long-Horizon Deep Research Agents


37. Routing by Reasoning Need: Trajectory-Aware Decoding Control for Diffusion Vision-Language Models


38. Memory Compression for High-Fanout Agent Sandboxes


39. Off-Target Effects of Response-Style Alignment in a Korean 27B Language Model


40. Generating a Consistent Enterprise: Synthesis and Reference-Free Evaluation of Multi-System Business Data


41. When Does Text Inform? Benchmarking Information-Theoretic Metrics for Multimodal Time-Series Forecasting


42. Bio-inspired Learning and Decision-Making with Probabilistic In-Memory Computing Hardware: Part 1


43. Predicting Train Delays in Finland Using Machine Learning and Weather Data


44. AI-Powered Flare Combustion Efficiency Estimation


45. Sci-MMR: Benchmarking Multi-Step Evidence-Grounded Scientific Reasoning in Multimodal Agents


46. NovGauge: A Fine-Grained Benchmark for Diagnosing LLMs’ Capability in Paper Novelty Assessment


47. A Voice-Interactive Multi-Agent System for Smart Operating Rooms: Architecture Design and Key Technologies


48. CryptoL: Towards Scale Dominance and Physics Constraints Mitigation in Financial Multivariate Time Series Forecasting


49. An AI-Powered Culturally Aware Chatbot for Stress Detection and Wellness Support among Pakistani University Students Using NLP and Machine Learning


50. Agentic Share-of-Search: A Multi-Agent AI System for Competitive Decision-Making in LLM-Mediated E-Commerce


51. Can LLMs Follow Medical Expert Logic? A Benchmark for Hierarchical Logical Consistency in Risk-of-Bias Assessment


52. SemVerBench: Benchmarking LLM Comprehension of Version-Constraint Resolution Semantics


53. Debate-to-Skill: Capability-Bound Process Supervision for Industrial Query-to-Agent Annotation


54. Breaking Predictions Is Not Enough: Specified-Foil Counterfactuals for Temporal Graphs


55. DRG-MAPPO: Hierarchical Dynamic Role-Graph Multi-Agent Reinforcement Learning for Cooperative Air Combat


56. Autonomous Chemical Mechanistic Discovery through Agentic Reasoning and Validation


57. The Oligarch Barely Steers Model Collapse in Multi-Model Ecosystems


58. Same Day, Same Story; One Day Ahead, a Different Signal: The Dual Validity of Financial Sentiment


59. KuaiRP Series Role-playing Models Technical Report


60. Benchmark Radar: A Living Database and Search Engine for AI Benchmarks and Evaluation


61. MOSAIC: Query-Aware Exploration Policy Adaptation for GraphRAG


62. Fork Where the Model Changes Its Mind: Belief-Shift Branching for Tree-Structured Reinforcement Learning


63. Grounding Agent Memory: Environment-Probing Curation for Enterprise Agents


64. The Agent Incident Registry: Toward Preventing Repeated AI Agent Failures


65. Defining AI Agents: A Compendium of Criteria, Metrics, and Benchmarks


66. Demystifying the Privacy-Utility Trade-off in LLM Interactions


67. Decoupling Readiness from Release for Tail-Aware Scheduling of Agentic LLM Workflows


68. When Validation Stops Learning: Auditing Update Admission for Continual Embodied Agents


69. Studying Without a Syllabus: Task-Agnostic Environment Preprocessing


70. Towards a Deterministic Math Solver for Clinical Language Models


71. Finishing the Task Is Not Enough: Evaluating Agent Resilience and Considerate Participation under Accumulating Challenge


72. An Open Recipe for IMO Gold: Training Nemotron for Olympiad Mathematics


73. Quantifying the Memorization-to-Generalization Transition: Scaling Laws and Phase Structure in Grokking


74. Understanding LoRA Rank Trade-offs in Diffusion Model Fine-Tuning


75. A Multi-Stage Rule-Chaining Framework for Compositional and Interpretable Cognitive Reasoning


76. Automating Quadratic Unconstrained Binary Optimization (QUBO) Formulation Generation from Natural Language


77. Probabilistic Focal Search: Accelerating Bounded-Suboptimal Search via Lower-Bound Advancement


78. GPU-CFR: 80x Faster Counterfactual Regret Minimization by Compiling the Game to Static Dataflow and CUDA Graph Replay


79. General Quantification of Covariate and Concept Shifts


80. Generative Marketing Mix Modeling: A Causal Inference Framework Linking GEO and GEM to Business Impact


81. Domain-Specific Hallucination Detection in Large Language Models


82. Biology-in-the-loop: Amortized Adaptive Hit Discovery in CRISPR Screens


83. The Last AI Built by Humans: Toward Genuine Recursive Self-Improvement


84. RetroThinker: Enabling Retrospective Thinking in Speech LLMs


85. Model-Aware Schedules Improve Generation via Fiberwise Optimal Transport


86. Understanding Operator Attitudes Toward AI-Supported Decision Making in Maritime Operations


87. Logit Refiner: Improving Visual Autoregressive Models via Intra-Scale Dependency Modeling


88. Thinking with Looped Flows


89. Beyond Word Error Rate: A Switch Aware Evaluation of ASR and Audio Language Models on English Yoruba Code-Switched Speech


90. Recognizing Is Not Reversing: A Controlled Inversion Test of Fact-Preserving News Framing


91. LOCUS: Task-Aware Low-Rank Post-Training for Token-Efficient Language Generation


92. ORCH: Organizational Principles Enable Collective Intelligence in Embodied AI


93. Continuous-Time Acoustic Modelling with Neural Controlled Differential Equations


94. A Time-Based Readout for Vector-Matrix Multiplication in Fully Analog Memristive SNNs


95. Language-Augmented Semantic Priors for B-Spline Surface Fitting


96. ActSafeGuard: Differentiable and Training-Aligned Constraint Enforcement for Flow-Matching Policies


97. Ecdysis: Efficient and Effective Training of Runtime Harnesses for LLM Agents


98. Warrant Theory


99. ZipCodec: Ultra-Low-Frame-Rate Streaming Speech Coding


100. LoaDiff: Conditional Generation of Electricity Consumption Time Series for Energy Analytics


101. Physics-Informed Neural Networks to Infer the Perpendicular Energy Conductivity in the Scrape-Off Layer of Stellarator Devices


102. Learn the Solid, Not the File: Canonical Inputs for Neural Networks on CAD Boundary Representations


103. A Comparative Evaluation of Pre-trained Convolutional Neural Networks for Melanoma Detection


104. Learning Interaction between Image and Layout Priors for Joint Image-Layout Generation in Design Templates


105. Structural priors for data-efficient language learning


106. Cross-Lingual Clinical Annotation Projection as Constrained Text Generation: A Six-Language Study


107. Prevalence Determines Precision:Silent Contamination in Detector-Defined Datasets


108. Investigating catastrophic forgetting in sound event classification


109. SWRouter: Similarity-Contractive Window Routing for Multi-Turn Large Language Model Conversations


110. X-AuT: Progressive Audio-Encoder Compression for Speech LLMs with Cross-Scale Distillation


111. Deep-Fake CAPTCHA: Mitigating Next-Generation Social Engineering Attacks


112. Buyer Artificial Intelligence-Enabled Environmental Governance and Supplier Environmental Controversies: An Organizational Information Processing and Signaling


113. VikingRAG: Accurate and Token-efficient Retrieval-augmented Generation over Structured Documents


114. Agent-Integrated Software: Interaction Contracts and Continuous Assurance


115. Characterizing Bluesky Content Moderation Service: From Automation of Service to Landscape of Harms



117. On the Impact of Anonymization on the Performance of Large Language Models


118. E-CONAN (Entailment, CONtradition And Neutral) Benchmarks: Arabic Textual Entailment and Natural Inference Datasets


119. The Semantic Elevation Operator and the Closure of the Undecidable Class under Preservation


120. GRIPNet: Gaussian Radial Intensity Prior Guided Architecture for Pulmonary Nodule Detection in CT


121. Your Model Already Knows Don’t Teach It, Learn to Ask It: Soft Prompting for Few-Shot Adaptation of Vision-Language Models


122. 2AM: Grounding Agent-Side Memory as Guidance for Steerable Action Models in Long-Horizon Manipulation


123. Improving Faint Object Detection for Space Situational Awareness with Variational Autoencoders



125. From Evaluation to Enhancement: Benchmarking and Improving Think-with-Video Reasoning for Video Generative Models


126. HALDETECT at ImageEval 2026 Shared Tasks: Answer-First Contrastive Grounding with QLoRA


127. Solving Few-Shot Multiobjective Multitask Optimization via Iterative Sequential Transfer


128. AI Soccer Analyst: Stage-Aware and Verifiable Human-AI Collaboration for Soccer Data Analysis


129. X-RACE: XAI-assisted Recurrent neural network Attribution for Channel Estimation


130. (Whose defaults?) Is artificial intelligence reorienting archaeological methods?


131. Exploring Second-Order Pattern Recognition in Speaker Recognition


132. Beyond Visual Quality: Evaluating Physical Consistency under Ego-Motion with EgoGenEval



134. A Fragility Spectrum for Recursive Language-Model Training


135. Beyond Benchmarks: Using VLMs to Reveal Systematic Classification Failures Under Real World Conditions


136. How AI Coders Discuss, Disagree, and Reach Consensus: Challenges and Opportunities for LLM-Based Qualitative Coding


137. Less can be More: What Aspects of Speech Drive End-of-Turn Detection


138. T1: Terminal Agent Reinforcement Learning for Long-Horizon Tasks


139. Toward Interpretable Multimodal Fusion: Heat Conduction Modeling for Hyperspectral and LiDAR Joint Classification


140. BenchShield: Formal Model-Backed Instrumentation for Reward Integrity in LLM-Agent Evaluation Infrastructure


141. New Evidence, Same Choice: Testing Physical Experiment Selection in Vision Language Models


142. Topological Necessities: Mechanism-Invariant Strategic Subgoals for Cross-Embodiment Goal-Conditioned Control


143. DeFiFusion: Combining Transaction Events with Smart Contracts to Detect Price Manipulation Attacks


144. Importance Weighting for Unlabeled-unlabeled Learning under Distribution Shift


145. A Mathematical Theory of Pragmatic Information


146. EGGROLL, Unrolled: Understanding and Improving Low-Rank Evolution Strategies at Scale


147. What a Random Draw from the MCP Registry Contains, and What Tool-Use Benchmarks Contain Instead


148. Robust Multimodal Sentiment Analysis with Incomplete Modalities via Semantic-aware Completeness based Reconstruction


149. Evaluating Scaffolding-Oriented Multi-Agent Large Language Model System for Clinical Interview Training


150. AUC Maximization from Biased Positive-unlabeled Data with Confidence


151. ReactHuman: A Physics-Grounded Benchmark for Human-Like Reactive Decision-Making in Embodied Multimodal LLMs


152. Does Linguistic Structure Enrichment Enhance Coherence Assessment? Not With Current Architectures


153. DriftNet: A Dual-Head Trajectory Transformer for Detecting and Localizing Prompt Injection in LLM Agents


154. Story Imprinting: AI Assistants Absorb Traits from Human Characters They Resemble


155. No-Box Vulnerability Analysis: Description-only Detection of Indirect Prompt Injection Vulnerabilities in MCP Servers


156. Are We Really Doing Few-Shot Learning? A Critical Examination of Pre-Training Assumptions


157. Tapes Together Strong: The Co-evolution of Computation and Cooperation


158. Counterfactual Marginalisation: Framework for Evaluating Robustness to Nuisance Variables


159. Beyond Static Guarantees: Measuring the Static-Pass Dynamic-Fail Gap in Security-Sensitive and LLM-Generated Python Code


160. Multilingual in Name Only? Cultural and Linguistic Weaknesses of LLMs in Urdu


161. Adaptive Margin Ordinal Loss: Penalizing Center-Class Hedging in Ordinal Classification


162. When Synthetic Data Hurts: On Catastrophic Forgetting in Skill Retrieval for LLM Agents


163. Temporal and Multimodal Deep Learning for Cyberattack Detection in LEO Satellite Systems


164. CARTS: Contextual Autoregressive Rank Transcoding Steganography for Full-Capacity Keyed Text Encoding


165. The Truth Was Never Gone: Perfect Aliasing in Compliant-Context Truth Probes


166. AcFlow: Controlling Text-to-Image Diffusion Transformers via Learned Conditional Activation Flow


167. Architecting the Secure AI-SOC: A Neurosymbolic Framework for Pipeline Integrity and Threat Mitigation


168. Data-Efficient Language Modeling: From Frontier Advancement to Principle-Guided Model Improvement


169. A machine-checked proof of the Dong-Yang classification of optimal (n,4) binary codes for BSCs


170. Beyond Verified Answers: Solver-Informed Self-Distillation for Bootstrapping Operations Research Language Models


171. Role differentiation as ignition of a collective information engine: Structuration in Agent Populations