전체 AI 논문 - 2026-07-10

1. Ideas Have Genomes: Benchmarking Scientific Lineage Reasoning and Lineage-Grounded Idea Generation


2. Using AI-based Learning Assistants in Higher Education: A Large-Scale Descriptive Analysis


3. AUTOPILOT VQA: Benchmarking Vision-Language Models for Incident-Centric Dashcam Understanding


4. Workflow as Knowledge: Semantic Persistence for LLM-Mediated Workflows


5. The Illusion of Equivalency: Statistical Characterization of Quantization Effects in LLMs


6. Remember When It Matters: Proactive Memory Agent for Long-Horizon Agents


7. SolarChain-Eval: A Physics-Constrained Benchmark for Trustworthy Economic Agents in Decentralized Energy Markets


8. Formal Mechanisms for Market Stability in Self-Interested Agent Societies: A Marketplace Simulation Study


9. The complexities of patient-centred conversational artificial intelligence


10. Towards Precision Therapy in Hepatocellular Carcinoma: A Clinical-Reasoning LLM for Risk Stratification and Treatment Guidance


11. SHAP-Weighted Cross-Modal Expert Fusion for Emotion and Sentiment Recognition: Evidence and Limits


12. CommuniWave:A Machine Learning Model for Quantifying the Degree of Temporary Informal Behavior in Urban Communities


13. AI-guided stimuli discovery and generation to optimize facial emotion perception studies in autism


14. Drift-Aware Temporal Graph Rewiring (DATGR) for Adaptive Semantic Modeling in Biomedical Text


15. Applying JEPA-Style Predictive Learning to JA4-Derived Network Fingerprints


16. OmniFood-Bench: Evaluating VLMs for Nutrient Reasoning and Personalized Health Advice


17. Game Theory Driven Multi-Agent Framework Mitigates Language Model Hallucination


18. Towards Mechanistically Understanding Why Memorized Knowledge Fails to Generalize in Large Language Model Finetuning


19. FedOPAL: One-Shot Federated Learning via Analytic Visual Prompt Tuning


20. MobiDiff: Semantic-Aware Multi-Channel Discrete Diffusion for Human Mobility Data Generation


21. Blind-Spots-Bench: Evaluating Blind Spots in Multimodal Models


22. INTENT: An LSTM Framework for Vehicle Intention Prediction in Intersection Scenarios with Comprehensive Ablation Analysis


23. Psychological Competence as a Missing Dimension in AI Evaluation


24. Understanding Axes of Difficulty For Long Context Tasks Via PredicateLongBench


25. PolyUQuest: Verifiable Structure-Aware Web RAG over Heterogeneous Graphs


26. Different Teachers, Different Capabilities: Sub-1B On-Device Distillation for Structured Text Enrichment


27. MentalHospital: A Virtual Environment for Evaluating Psychiatric Clinical Encounters


28. Compete Then Collaborate: Frontier AI Teachers Build a Verifiable Curriculum to Improve a Coding Student Beyond Imitation


29. AutoPersonas: A Multi-Timescale Loop Engine for Open-Ended Persona Evolution


30. Playing ZendoWorld: Challenging AI Agents on Active Visual Concept Induction


31. A First-Principles Theory of Slow Thinking and Active Perception


32. ASMR: Agentic Schema Generation for Ship Maintenance Report Writing


33. Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets


34. Answer Set Programming Energised! End-to-End Neurosymbolic Reasoning and Learning with ASP and Energy Based Models


35. CausalDS: Benchmarking Causal Reasoning in Data-Science Agents


36. PARA-PV: Physics-Aware Retrieval-Augmented PV Prediction Based on Frozen Foundation Model and Distribution Shift Correction


37. Persuasion Attacks Can Decrease Effectiveness of CoT Monitoring


38. When LLMs Agree, Are They Right? Auditing Self-Consistency and Cross-Model Agreement as Confidence Signals


39. A safety-oriented hypothetico-deductive framework for AI-assisted differential diagnosis


40. From Prompts to Contracts: Harness Engineering for Auditable Enterprise LLM Agents


41. Concretized Proposition Prompting Resolves Composition-Knowledge Dichotomy in Large Language Models




44. Persona Cartography: Charting Language Model Personality Traits in Weight Space


45. Nigeria Machinery: A Low-Resource Industrial Dataset with a Domain-Grounded Reasoning Layer


46. Feedback Manipulation Regularization: Enabling Offline Agent Alignment for Imitation Learning


47. Agentic AI and Retrieval-Augmented Models in Straight-Through Underwriting


48. A Graph Neural Network Model for Real-Time Gesture Recognition Based on sEMG Signals


49. VectorizationLLM: Smart Vectorization Based AI Assistant


50. Infinity-Parser2 Technical Report


51. Idiobionics: The Unification of Privacy and Intelligent Robotic Prostheses


52. Alignment Plausibility: A New Standard for Assuring AI in Healthcare


53. Aligning Clinical Needs and AI Capabilities: A Survey on LLMs for Medical Reasoning


54. Adversarial Social Epistemology for Assemblies of Humans and Large Language Models


55. AI-integrated models for assessing agricultural resilience


56. Context Graphs for Proactive Enterprise Agents


57. OpenCoF: Learning to Reason Through Video Generation


58. SLORR: Simple and Efficient In-Training Low-Rank Regularization


59. Dimensionality Reduction Meets Network Science: Sensemaking on UMAP’s kNN Graph


60. Validity of LLMs as data annotators: AMALIA on authority


61. Pose-to-Biomechanics: Bridging 3D Human Pose Estimation and Biomechanical Attribute Prediction


62. ProjAgent: Procedural Similarity Retrieval for Repository-Level Code Generation


63. A Practical Investigation of Training-free Relaxed Speculative Decoding



65. Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning


66. UltraX: Refining Pre-Training Data at Scale with Adaptive Programmatic Editing


67. When Structured Sparse Autoencoders Learn Consistent Concepts Across Modalities


68. SMetric: Rethink LLM Scheduling for Serving Agents with Balanced Session-centric Scheduling


69. VocaDet: Sample-Driven Open-Vocabulary Object Detection and Segmentation via Visual Tokenization and Vector Database Retrieval


70. DocMaster: A Hierarchical Structure-Aware System for Document Analysis


71. When the Judge Changes, So Does the Measurement: Auditing LLM-as-Judge Reliability


72. Cognitive-structured Multimodal Agent for Multimodal Understanding, Generation, and Editing


73. The Context Access Divide: Interaction-Level Architecture as a Complementary Dimension of Agentic Inequality


74. VEGAS: Human-Aligned Video Caption Evaluation via Gaze


75. Two Axes of LLM Abstention: Answer Correctness and Question Answerability


76. Spatio-Temporal Scheduling Prediction Under Backhaul Delay for Resilient Coordinated Beamforming


77. ADORN: Adaptive Drift handling for Open RAN using Reinforcement Learning


78. EgoWAM: World Action Models Beyond Pixels with In-the-Wild Egocentric Human Data


79. Predicting Male Fertility Using Machine Learning: A Semen Parameters Based Analysis with the VISEM Dataset


80. When Synthetic Speech Is All You Have: Better Call GRPO


81. Track2Map: Online Deformable SLAM with Motion-Aware Pose Optimization in Robotic Surgery


82. DrugGen 2: A disease-aware language model for enhancing drug discovery


83. Swapping Faces, Saving Features: A Dual-Purpose Pipeline for Pedestrian Privacy in ITS


84. TRACE: A Two-Channel Robust Attribution Watermark via Complementary Embeddings for LLM-Agent Trajectories


85. WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving


86. Large-Language-Models-as-a-Judge in Theory-Agnostic Adaptive Metric-Alignment for Prototypical Networks in Personality Recognition


87. Self-Adaptive Anomaly Detection with Reinforcement Learning and Human Feedback in Connected Vehicles


88. On the Role of Conversational Timing in Synthetic Training Data for ASR


89. FSD-VLN: Fast-Slow Dual-System Modeling for Aerial Long-Horizon Vision-Language Navigation


90. Spectral Analysis of Dueling Q-Learning


91. TypeProbe: Recovering Type Representations from Hidden States of Pre-trained Code Models


92. ArtMine: Discovering and Formalizing Artistic Processes


93. GitLake: Git-for-data for the agentic lakehouse


94. From Legacy Documentation to OSCAL: An MCP-Based Agent Pipeline for Threat-Informed Continuous Compliance in Critical Infrastructure


95. Multi-Agent Firewall Architecture for Privacy Protection of Sensitive Data in Interactions with Language Models


96. Best-of-$N$ TTS Evaluation is Confounded by ASR Family Alignment


97. RhyMix: A Lightweight Adaptive Multi-Rhythm Network for Long-Term Time Series Forecasting


98. TMI: Text-to-Image Meets Image-to-Image for Complementary Data Synthesis to Boost Long-Tailed Instance Segmentation


99. Open-ended Multi-agent Autocurricula via Visual Inspection of Policies with Multi-modal LLMs


100. Leveraging Color Naming for Image Enhancement


101. LEEVLA: Seeing What Matters in Latent Environment Evolution for Vision-Language-Action


102. Out of Sight: Compression-Aware Content Protection against Agentic Crawlers


103. ProsMAE: Multi-Source MAE Pretraining for ISUP Grade Classification


104. LEXIC: Lightweight Eye-tracking eXtension via Injected Complexity


105. Prismata: Confining Cross-Site Prompt Injection in Web Agents


106. ICDAR 2026 HIPE-OCRepair Competition on LLM-Assisted OCR Post-Correction for Historical Documents


107. PS4: Proxy-Supervised Joint Training for Real Target Speaker Extraction


108. Deep Learning Method for Stationary Distribution of Reflected Brownian Motion


109. LDFE: Laplacian Decoupled Feature Enhancement Block for Dual-Stream CNN-based RGB-IR Object Detection


110. COBART: Controlled, Optimized, Bidirectional and Auto-Regressive Transformer for Ad Headline Generation


111. When Thinking Hurts: Epistemic Signals in the Reasoning Chains of Visual Language Models


112. Towards Efficient Large Language Model Serving: A Survey on System-Aware KV Cache Optimization


113. Reinforcing the Generation Order of Multimodal Masked Diffusion Models


114. Who Analyses the Analyser? Self-Validating LLM Hazard Analysis with Constitutional Meta-STPA


115. What LLM Forecasters Know but Don’t Say: Probing Internal Representations for Calibration and Faithfulness


116. Aleena: Alignment Agent for Research Software Engineering Collaborations


117. PLURAL: A Global Dataset for Value Alignment


118. DKDNet: Dual Knowledge and Data-Driven Network for Cross-Domain Automatic Modulation Classification


119. Structured Pruning of Large Language Models via Power Transformation and Sign-Preserving Score Aggregation with Adaptive Feature Retention


120. APIVOT: Adaptive Planning with Interleaved Vision-Language Thoughts


121. Can We Trust LLM’s Logic? Quantifying Uncertainty, Coherence, and Robustness via a Graph-Based Framework


122. Provably Optimal Learning Algorithms for Assistance Games


123. Beware What You Autocomplete: Forensic Attribution of Backdoored Code Completions


124. Reaction-network reasoning with frontier models for experimentally confirmed catalyst-selectivity hypotheses


125. SpO$_2$ Predictor-Guided Stage-Wise Time-Frequency Reconstruction of Low-Quality Dual-Wavelength PPG for Oxygen Saturation Estimation


126. Who Broke the System? Failure Localization in LLM-Based Multi-Agent Systems


127. A Reliability Assessment of LALM Audio Judges for Full-Duplex Voice Agents


128. 3100 Opinions on Code Review in an AI World: Building Causal Theory from Practitioner Discourse


129. When Implausible Tokens Get Reinforced: Tail-Aware Credit Calibration for LLM Reinforcement Learning


130. A Multi-cluster Boundary Learning Method for Out-of-Scope Intent Detection via MiniLM Embedding


131. Beyond Thermal Imaging: Inferring Thermophysical Properties from Time-Resolved Thermal Observations


132. Linear Attention Architectures: Mechanisms, Trade-offs, and Cross-Layer Routing


133. path_boost: A Python Package for Interpretable Graph-Level Prediction using Path-Based Gradient Boosting


134. Adversarial Decoys: Misdirecting Attention-Based Defenses in ViT


135. Efficient Safety Alignment of Language Models via Latent Personality Traits


136. Multimodal Unlearning Across Vision, Language, Video, and Audio: Survey of Methods, Datasets, and Benchmarks


137. Mechanistic Interpretability of LLM Jailbreaks via Internal Attribution Graphs


138. Closed-Loop Dynamic Validator Node Scaling in Private Substrate Blockchains Using Takagi-Sugeno Fuzzy Inference


139. How Do I Know What to Say Next? Barenholtz’s Autogenerative Theory as an Enrichment of Harrisean Integrationism


140. Time-to-Collision Based Dynamic Obstacle Avoidance Using Pretrained Vision Models for Robots in Unstructured Environments


141. Multi-agent Autoformalization of Tensor Network Theory


142. Kime-Representation Formulations of Three Open Problems in the Foundations of Classical Mechanics: Uncertainty, Invariant Entropy, and Directional Degrees of Freedom


143. Shift & Drift: A Zero-Shot Benchmark for Generalizable and Robust Autonomous Driving Motion Planning


144. From Triggers to Emotions: A CPM-Grounded Appraisal Multi-Agent for Dynamic Emotional Evolution in Persona-Based Dialogue


145. DreamCharacter-1: From 3D Generative Foundation Models to Product-Ready Character Generation


146. From Solvers to Research: Large Language Model-Driven Formal Mathematics at the Research Frontier


147. Graph-Regularized Deep Learning for EEG-Based Emotion Recognition with Psychologically-Grounded Label Structure


148. Principled Analysis of Deep Reinforcement Learning Evaluation and Design Paradigms


149. A Transdiagnostic Space of Disorder Like Phenotypes in Reinforcement Learning Agents


150. Architecture Generalization with MetaNCA


151. Jet-Long: Efficient Long-Context Extension with Dynamic Bifocal RoPE


152. Collective Intelligence with Foundation Models


153. SHIFT: Survival Prediction from Incomplete and Heterogeneous Genomic Data


154. Omni-Sleep: A Sleep Foundation Model via Hierarchical Contrastive Learning of CNS–ANS Dynamic


155. ReCoLoRA: Spectrum-Aware Recursive Consolidation for Continual LLM Fine-Tuning


156. LLT: Local Linear Transformer for PDE Operator Learning


157. Towards the Explainability of Temporal Graph Networks via Memory Backtracking and Topological Attribution