전체 AI 논문 - 2026-06-18

1. Rethinking Reward Supervision: Rubric-Conditioned Self-Distillation


2. NeSyCat Torch: A Differentiable Tensor Implementation of Categorical Semantics for Neurosymbolic Learning


3. X+Slides: Benchmarking Audience-Conditioned Slide Generation


4. TxBench-PP: Analyzing AI Agent Performance on Small-Molecule Preclinical Pharmacology


5. User as Engram: Internalizing Per-User Memory as Local Parametric Edits


6. Beyond Safe Data: Pretraining-Stage Alignment with Regular Safety Reflection


7. Human-AI Coevolution Dynamics: A Formal Theory of Social Intelligence Emergence Through Long-Term Interaction


8. Analysing drivers and interdependencies in European electricity markets using XAI


9. Towards an Agent-First Web: Redesigning the Web for AI Agents


10. ARIADNE: Agnostic Routing for Inference-time Adapter DyNamic sElection


11. RODS: Reward-Driven Online Data Synthesis for Multi-Turn Tool-Use Agents


12. ThinkDeception: A Progressive Reinforcement Learning Framework for Interpretable Multimodal Deception Detection


13. RTSGameBench: An RTS Benchmark for Strategic Reasoning by Vision-Language Models


14. Decoupling Search from Reasoning: A Vendor-Agnostic Grounding Architecture for LLM Agents


15. SciRisk-Bench: A Risk-Dimension-Aware Benchmark for AI4Science Safety


16. Skill-Guided Continuation Distillation for GUI Agents


17. Generative-Model Predictive Planning for Navigation in Partially Observable Environments


18. Externalizing Research Synthesis and Validation in AI Scientists through a Research Harness


19. WorldLines: Benchmarking and Modeling Long-Horizon Stateful Embodied Agents


20. ProfiLLM: Utility-Aligned Agentic User Profiling for Industrial Ride-Hailing Dispatch


21. R2D-RL: A RoboCup 2D Soccer Environment for Multi-Agent Reinforcement Learning


22. What Must Generalist Agents Remember?


23. ForecastBench-Sim: A Simulated-World Forecasting Benchmark


24. Optimizing Lithium Production Decisions under Geological, Demand, and Pricing Uncertainties: A POMDP Framework for Multi-Objective Decision Making


25. DeFAb: A Verifiable Benchmark for Defeasible Abduction in Foundation Models


26. CEO-Bench: Can Agents Play the Long Game?


27. Searching for Synergy in Shared Workspace Human-AI Collaboration


28. CaVe-VLM-CoT: An Interpretable Vision-Language Model Framework


29. NAVI-Orbital: First In-Orbit Demonstration of a Zero-Shot Vision-Language Model for Autonomous Earth Observation


30. UBP2: Uncertainty-Balanced Preference Planning for Efficient Preference-based Reinforcement Learning


31. Reference-Driven Multi-Speaker Audio Scene Generation from In-the-Wild Priors


32. Data Intelligence Agents: Interpreting, Modeling, and Querying Enterprise Data via Autonomous Coding Agents


33. Explaining Attention with Program Synthesis


34. Correct Yourself, Keep My Trust: How Self-Correction and Social Connection Shape Credibility in Social Chatbots


35. Trade-offs in Medical LLM Adaptation: An Empirical Study in French QA


36. A Multi-Domain Benchmark for Detecting AI-Generated Text-Rich Images from GPT-Image-2


37. OneCanvas: 3D Scene Understanding via Panoramic Reprojection


38. A Taxonomy of Mental Health and Technology Needs for Alzheimer’s and Dementia Caregivers


39. STARE: Surprisal-Guided Token-Level Advantage Reweighting for Policy Entropy Stability


40. Mechanism-Guided Selective Unlearning for RLVR-Induced Reasoning


41. Machine Unlearning for the XGBoost Model with Network Intrusion Datasets


42. Forecasting what Matters: Decision-Focused RL for Controlled EV Charging with Unknown Departure Times


43. The More the Merrier: Combining Properties for ABox Abduction under Repair Semantics for ELbot


44. Language Models as Interfaces, Not Oracles: A Hybrid LLM-ML System for Pediatric Appendicitis


45. Compute Efficiency and Serial Runtime Tradeoffs for Stochastic Momentum Methods


46. Hardware- and Vision-in-the-Loop Validation of Deep Monocular Pose Estimation for Autonomous Maritime UAV Flight


47. A Clinician-Centered Pipeline for Annotation and Evaluation in Ultrasound AI Studies


48. Essential Subspace Merging for Multi-Task Learning


49. AdsMind: A Physics-Grounded Multi-Agent System for Self-Correcting Discovery of Adsorption Configurations on Heterogeneous Catalyst Surfaces


50. OrthoReg: Orthogonal Regularization for Hybrid Symbolic-Neural Dynamical Systems


51. A Technical Taxonomy of LLM Agent Communication Protocols


52. Pareto Q-Learning with Reward Machines


53. Equivariant Graph Neural Networks Improve Optical Spectra Prediction for Materials Screening


54. Leadership as Coordination Control: Behavioral Signatures and the Recovery-Advantage Boundary in Multi-Agent LLM Teams


55. ProductConsistency: Improving Product Identity Preservation in Instruction-Based Image Editing via SFT and RL


56. Where Did the Variability Go? From Vibe Coding to Product Lines by Regeneration


57. A Hybrid LSTM–Vision Transformer Architecture for Predicting HRRR Forecast Errors


58. FoMoE: Breaking the Full-Replica Barrier with a Federation of MoEs


59. Spotlight: Synergizing Seed Exploration and Spot GPUs for DiT RL Post-Training


60. TRAP: Benchmark for Task-completion and Resistance to Active Privacy-extraction


61. G-IdiomAlign: A Gloss-Pivoted Benchmark for Cross-Lingual Idiom Alignment


62. Beyond Tokenization: Direct Timestep Embedding and Contrastive Alignment for Time-Series Question Answering


63. CAPRA: Scaling Feedback on Software Architecture Deliverables with a Multi-Agent LLM System


64. A Controlled Benchmark of Quantum-Latent GAN Augmentation for Brain MRI


65. TransitNet: A Compact Attention-Augmented Deep Learning Framework for Low-SNR Transit Blind Searches


66. As Easy as Rocket Science: Assessing the Ability of Large Language Models to Interpret Negation in Figurative Language


67. SAERec: Constructing Fine-grained Interpretable Intents Priors via Sparse Autoencoders for Recommendation


68. Domain-Shift Aware Neural Networks for Unbalance Characterization in Rotating Systems


69. Scaling Learning-based AEB with Massive Unlabeled Data


70. URDF Synthesis from RGB-D Sequences via Differentiable Joint Inference and Energy-Consistent Verification


71. Aligning Implied Statements for Implicit Hate Speech Generalizability with Context-Bounded Semi-hard Negative Mining


72. Skill-MAS: Evolving Meta-Skill for Automatic Multi-Agent Systems


73. Improving Human-Robot Teamwork in Urban Search and Rescue Through Episodic Memory of Prior Collaboration


74. Target-confidence Recourse Using tSeTlin machines: TRUST


75. Beyond Reward Engineering: A Data Recipe for Long-Context Reinforcement Learning


76. Space Is Intelligence: Neural Semigroup Superposition for Riemannian Metric Generation


77. Maturing Markov Decision Processes: Decision Making under Increasing Information and Shrinking Action Sets


78. SwitchBraidNet: Quantisation-Aware Lightweight Architecture for Hybrid Brain-Computer Interface


79. Reinforcement Learning Foundation Models Should Already Be A Thing


80. Rescaling MLM-Head for Neural Sparse Retrieval


81. Learning from Own Solutions: Self-Conditioned Credit Assignment for Reinforcement Learning with Verifiable Rewards


82. SHIFT: Semantic Harmonization via Index-side Feature Transformation for Multilingual Information Retrieval


83. Closing the Loop: PID Feedback Control for Interpretable Activation Steering in Symbolic Music Generation


84. Bayesian Anytime Pareto Set Identification for Multi-Objective Multi-Armed Bandits


85. RedactionBench


86. Private Learning with Public Feature Conditioning


87. Generating Natural and Expressive Robot Gestures through Iterative Reinforcement Learning with Human Feedback using LLMs


88. SWE-Future: Forecast-Conditioned Data Synthesis for Future-Oriented Software Engineering Agents


89. Two-Phase Bilevel Search for the Moving-Target Traveling Salesman Problem with Moving Obstacles


90. Graph Grounded Cross Attention Transformer Neural Network for Structurally Constrained Full Event Sequence Generation in Predictive Process Monitoring


91. Morpheus: A Morphology-Aware Neural Tokenizer and Word Embedder for Turkish



93. Leveraging Energy Features for Surface Classification with Deep Learning: A Comparative Analysis Across Three Independent Datasets


94. Dual-Channel Grounded World Modeling (DCGWM): Structural Prevention of Objective Interference Collapse via Heterogeneous External Grounding with Inward-Only Gradient Flow


95. Bounded Context Management for Tabular Foundation Models on Stream Learning


96. scGTN: Deep Siamese Graph Transformer Network for Single-cell RNA Sequencing Clustering


97. NeuralMUSIC: A Hybrid Neural-Subspace Framework for Robot Sound Source Localization


98. LandslideAgent with Multimodal LandslideBench: A Domain-Rule-Augmented Agent for Autonomous Landslide Identification and Analysis


99. Augmenting Dysarthric Speech Severity Assessment with MOS Supervision


100. PEC-Home: Interpretation of Progressively Elliptical Commands in Smart Homes


101. EffiNav: Fusing Depth and Vision-Language for Efficient Object Goal Navigation


102. BCL: Bayesian In-Context Learning Framework for Information Extraction


103. Code-Augur: Agentic Vulnerability Detection via Specification Inference


104. AI-Driven Assessment of Human Tutors: Linking Training Performance to Real-Life Practice


105. Are LLMs Ready to Assist Physicians? PhysAssistBench for Interactive Doctor-Patient-EHR Assistance


106. QC-GAN: A Parameter-Efficient Quaternion Conformer GAN for High-Fidelity Speech Enhancement


107. Steerable Cultural Preference Optimization of Reward Models


108. MIDS: Detecting Stealthy Masquerade and Tampering Attacks on CAN Bus via Bidirectional Mamba


109. Better Adherence, Richer Context: A Field Evaluation of LLM-Powered Conversational Voice Diaries for Sleep


110. Benchmarking Action Spaces in Reinforcement Learning for Vision-based Robotic Manipulation


111. Dual Dimensionality for Local and Global Attention


112. APT: Atomic Physical Transitions for Causal Video-Language Understanding


113. Multi-Modal Hyper-Graph Fusion for Low-Light Crowd Counting


114. Correcting Sensor-Induced Distribution Drift with Wasserstein Adversarial Learning


115. Engagement Intensity as a Learner-Modeling Signal for Adaptive AI Ethics Instruction


116. AI Sandboxes: A Threat Model, Taxonomy, and Measurement Framework


117. Sparsity Curse: Understanding RLVR Model Parameter Space from Model Merging


118. As You Wish: Mission Planning with Formal Verification using LLMs in Precision Agriculture


119. PSyGenTAB: A Privacy-Preserving Framework for Synthetic Clinical Tabular Data Generation via Constrained Optimization


120. Neural Phase Correlation


121. SFT Overtraining Predicts Rank Inversion via Entropy Collapse Under RLVR


122. MagpieTTS-LF: Inference-Time Long-Form Speech Generation Without Training on Long-Form data


123. Structured Representation Learning with Locally Linear Embeddings and Adaptive Feature Fusion


124. What Does the Weight Norm Control in Grokking? Logit-Scale Mediation under Cross-Entropy


125. Veriphi: Attack-Guided Neural Network Verification with Dataset-Dependent Training Methods


126. TMR-GGNN: Credit Card Fraud Detection based on Time-Aware Multi-Relational Guided Graph Neural Network


127. CAOA – Completion-Assisted Object-CAD Alignment


128. From Specification to Execution: AI Assisted Scientific Workflow Management


129. A Variational Framework for LLM Generator-Regulator Games


130. Deep-Learning-Based Pixelated Microwave Filter Design and Characterization using Electro-Optical Electric-Field Measurements


131. Deep Learning-Driven Inverse Design of Doherty Power Amplifiers Using Pixelated Combiners and Dual-State Impedance Synthesis


132. Learning-Based Decision Making for Combustion Phasing Control in Multi-Fuel CI Engines with Latent Fuel Reactivity Estimation


133. LLMZero: Discovering Adaptive Training Strategies for RL Post-Training via LLM Agents


134. RankGraph-2: Lifecycle Co-Design for Billion-Node Graph Learning in Recommendation


135. Redact or Keep? A Fully Local AI Cascade for Educational Dialogue De-Identification


136. Guava: An Effective and Universal Harness for Embodied Manipulation


137. SafeClawBench: Separating Semantic, Audit-Evidence, and Sandbox Harm in Tool-Using LLM Agents


138. Self-CTRL: Self-Consistency Training with Reinforcement Learning


139. Agentra: A Supervisable Multi-Agent Framework for Enterprise Intrusion Response


140. Why SWAVE May Not Be All You Need:A Concept-Evolution Retrospective on Complex-Valued Recurrent Language Models


141. SAE Interventions are Unreliable: Post-Intervention Recovery of Suppressed Behavior


142. ASTRA: A Scalable Next-Generation ATCO Training Simulator with Autonomous Simpilots


143. Ghost Attractor Networks: Basin-Structured Dynamical Decoders for Closed-Loop Sequential Generation


144. Conflict-Aware Retriever Editing for Knowledge Injection Attacks on LLM-Based RAG Systems


145. SAGE: Retain-Aware Post-Hoc Sanitization of Final Unlearning Vector


146. TRIDENT: Breaking the Hybrid-Safety-Physics Coupling for Provably Safe Multi-Agent Reinforcement Learning


147. DRIFT: Refining Instruction Data via On-Policy Data Attribution


148. Attribution-Guided and Coverage-Maximized Pruning for Structural MoE Compression



150. Vibe Coding Ate My Homework: An evaluation of AI approaches to greenfield software engineering and programming


151. A Knowledge Theory of Capital:The Value of Natural and Artificial Intelligence


152. Breaking the Solver Bottleneck: Training Task Generators at the Learnable Frontier


153. IOAH3: Importance-Driven Adaptive Spatial Partitioning


154. Continuous Audio Thinking for Large Audio Language Models


155. Mitigating Anchoring Bias in LLM-Based Agents for Energy-Efficient 6G Autonomous Networks


156. Towards Multi-Agent-Simulation-Based Community Note Evaluation


157. EMORSION: Examining the Impact of Audio Parameters on Emotional Responses and Immersion in Film


158. Synthetic Resonance: A Framework for Growth-Oriented Human-AI Relationships


159. Simulating Hate Speech Cascades with Multi-LLM Agents: Empirical Grounding, Modeling Fidelity, and Intervention Strategies


160. How Well Do Large Language Models Capture Human Personality?


161. Caring Without Feeling: Affective Dynamics as the Control Layer of Human-AI Agent Collaboration


162. Examining Human-Like Behaviors in LLMs: A Multi-Dimensional Analysis of Model Behaviors, User Factors, and System Prompts


163. From Memorization to Creation: Evaluating the Cognitive Depth of LLM-Generated Educational Questions


164. Dynamic In-Group Persona Generation for Enhancing Human-AI Rapport


165. QSignAI: Quantum-Randomness-Seeded Identity Signatures at the Intersection of AI for Science and Science for AI