LLM 관련 주요 논문 - 2026-06-18

1. Rethinking Reward Supervision: Rubric-Conditioned Self-Distillation


2. X+Slides: Benchmarking Audience-Conditioned Slide Generation


3. User as Engram: Internalizing Per-User Memory as Local Parametric Edits


4. Beyond Safe Data: Pretraining-Stage Alignment with Regular Safety Reflection


5. ThinkDeception: A Progressive Reinforcement Learning Framework for Interpretable Multimodal Deception Detection


6. RTSGameBench: An RTS Benchmark for Strategic Reasoning by Vision-Language Models


7. Decoupling Search from Reasoning: A Vendor-Agnostic Grounding Architecture for LLM Agents


8. SciRisk-Bench: A Risk-Dimension-Aware Benchmark for AI4Science Safety


9. ProfiLLM: Utility-Aligned Agentic User Profiling for Industrial Ride-Hailing Dispatch


10. DeFAb: A Verifiable Benchmark for Defeasible Abduction in Foundation Models


11. CEO-Bench: Can Agents Play the Long Game?


12. CaVe-VLM-CoT: An Interpretable Vision-Language Model Framework


13. NAVI-Orbital: First In-Orbit Demonstration of a Zero-Shot Vision-Language Model for Autonomous Earth Observation


14. Explaining Attention with Program Synthesis


15. Trade-offs in Medical LLM Adaptation: An Empirical Study in French QA


16. A Multi-Domain Benchmark for Detecting AI-Generated Text-Rich Images from GPT-Image-2


17. OneCanvas: 3D Scene Understanding via Panoramic Reprojection


18. Language Models as Interfaces, Not Oracles: A Hybrid LLM-ML System for Pediatric Appendicitis


19. AdsMind: A Physics-Grounded Multi-Agent System for Self-Correcting Discovery of Adsorption Configurations on Heterogeneous Catalyst Surfaces


20. A Technical Taxonomy of LLM Agent Communication Protocols


21. Leadership as Coordination Control: Behavioral Signatures and the Recovery-Advantage Boundary in Multi-Agent LLM Teams


22. Where Did the Variability Go? From Vibe Coding to Product Lines by Regeneration


23. FoMoE: Breaking the Full-Replica Barrier with a Federation of MoEs


24. Spotlight: Synergizing Seed Exploration and Spot GPUs for DiT RL Post-Training


25. Beyond Tokenization: Direct Timestep Embedding and Contrastive Alignment for Time-Series Question Answering


26. CAPRA: Scaling Feedback on Software Architecture Deliverables with a Multi-Agent LLM System


27. As Easy as Rocket Science: Assessing the Ability of Large Language Models to Interpret Negation in Figurative Language


28. SAERec: Constructing Fine-grained Interpretable Intents Priors via Sparse Autoencoders for Recommendation


29. Skill-MAS: Evolving Meta-Skill for Automatic Multi-Agent Systems


30. Beyond Reward Engineering: A Data Recipe for Long-Context Reinforcement Learning


31. Rescaling MLM-Head for Neural Sparse Retrieval


32. RedactionBench


33. Generating Natural and Expressive Robot Gestures through Iterative Reinforcement Learning with Human Feedback using LLMs


34. Graph Grounded Cross Attention Transformer Neural Network for Structurally Constrained Full Event Sequence Generation in Predictive Process Monitoring


35. Morpheus: A Morphology-Aware Neural Tokenizer and Word Embedder for Turkish



37. LandslideAgent with Multimodal LandslideBench: A Domain-Rule-Augmented Agent for Autonomous Landslide Identification and Analysis


38. PEC-Home: Interpretation of Progressively Elliptical Commands in Smart Homes


39. BCL: Bayesian In-Context Learning Framework for Information Extraction


40. Code-Augur: Agentic Vulnerability Detection via Specification Inference


41. Steerable Cultural Preference Optimization of Reward Models


42. Better Adherence, Richer Context: A Field Evaluation of LLM-Powered Conversational Voice Diaries for Sleep


43. Engagement Intensity as a Learner-Modeling Signal for Adaptive AI Ethics Instruction


44. As You Wish: Mission Planning with Formal Verification using LLMs in Precision Agriculture


45. From Specification to Execution: AI Assisted Scientific Workflow Management


46. A Variational Framework for LLM Generator-Regulator Games


47. LLMZero: Discovering Adaptive Training Strategies for RL Post-Training via LLM Agents


48. Redact or Keep? A Fully Local AI Cascade for Educational Dialogue De-Identification


49. Guava: An Effective and Universal Harness for Embodied Manipulation


50. SafeClawBench: Separating Semantic, Audit-Evidence, and Sandbox Harm in Tool-Using LLM Agents


51. Self-CTRL: Self-Consistency Training with Reinforcement Learning


52. Why SWAVE May Not Be All You Need:A Concept-Evolution Retrospective on Complex-Valued Recurrent Language Models


53. Conflict-Aware Retriever Editing for Knowledge Injection Attacks on LLM-Based RAG Systems


54. SAGE: Retain-Aware Post-Hoc Sanitization of Final Unlearning Vector


55. DRIFT: Refining Instruction Data via On-Policy Data Attribution


56. Vibe Coding Ate My Homework: An evaluation of AI approaches to greenfield software engineering and programming


57. Continuous Audio Thinking for Large Audio Language Models


58. Mitigating Anchoring Bias in LLM-Based Agents for Energy-Efficient 6G Autonomous Networks


59. Simulating Hate Speech Cascades with Multi-LLM Agents: Empirical Grounding, Modeling Fidelity, and Intervention Strategies


60. How Well Do Large Language Models Capture Human Personality?


61. Caring Without Feeling: Affective Dynamics as the Control Layer of Human-AI Agent Collaboration


62. Examining Human-Like Behaviors in LLMs: A Multi-Dimensional Analysis of Model Behaviors, User Factors, and System Prompts


63. From Memorization to Creation: Evaluating the Cognitive Depth of LLM-Generated Educational Questions


64. Dynamic In-Group Persona Generation for Enhancing Human-AI Rapport