전체 AI 논문 - 2026-09-21

1. Designer-RSI: Evolving Procedural Memory from User Traffic for Agentic Graphic Design


2. CodeMidas: Scaling Agentic Coding RL Environments from Code Itself


3. A Lie Detector Test for Language Models: Reading Knowledge a Model Won’t Reveal


4. Learning Cardiac Features: ECG Biometrics Across Time and~Exercise


5. AutoViewMem: Self-Configuring Orthogonal Views for Conversational Long-Term Memory


6. What Should We Ask Next? Retrieval-Aware Question Learning under Partial Evidence


7. AutoRecLab: Describe the Experiment, Get the Code!


8. EnterpriseVal: Quantifying the Efficacy, Reliability and Value of Generative AI in the Enterprise


9. MIST: Multimodal Survival Prediction with Genomic-Guided Histology Attention


10. LLM-Generated Feature Pools for Time Series Anomaly Detection


11. ECG Mirage: Revealing and Mitigating the Underutilisation of ECGs in Vision-Language Models for Clinical Prediction


12. World Modeling in Transformers


13. Listen Before You Speak: Response Planning from Listener Facial Reactions for Conversational Speech Generation


14. GUARD: Natural Forgetting in Large Reasoning Models via Guided Answer-Reasoning Distillation


15. Accelerating Dense LLMs via L0-regularized Mixture-of-Experts


16. One Prompt Does Not Fit All: Self-Meta-Evolve for Personalized Information Extraction


17. Calibrating Teacher–Student Discrepancy for On-Policy Distillation


18. Reducing Barriers to Academic Support: Evaluating a Course-Specific RAG System for Addressing Help-Seeking Disparities in Higher Education


19. Beyond Accuracy: Centroid-Guided Contrastive Loss for Structured Fraudulent Job Posting Detection


20. Dual-Interest Sequential Product Recommendation With Multi-Granular SSM


21. Learning-to-Optimize as the Missing Architectural Layer of AI-Native Networks


22. The Communication Bottleneck: A Round-Trip Study of Tree-Structured Expression Serialization in Language Models


23. PolyBridgeBench: Benchmarking Multimodal LLMs for Physics-Grounded Bridge Design


24. LogicTrack: Auditing Reasoning Trajectories of Large Language Models with Formal Logic Solvers


25. Driving on Registers, Reasoning on Risk: Risk-Aware Occupancy for Register-Based End-to-End Autonomous Driving


26. Risk-Aware Occupancy for Safety-Oriented End-to-End Autonomous Driving


27. GVPO++: Group Variance Policy Optimization for LLM Post-Training and On-Policy Distillation


28. DENSE: Distilling Agent Trajectories into Evidence-Grounded Shortcut Trees for Self-Refinement


29. Offline Multimodal Large Language Models for Decision Support in Air Operations


30. LEGIT: Credentialing Protocol for Trustworthy AI Agent Marketplaces


31. GameASG-Bench: Benchmarking Autonomous Software Generation for Game Development


32. Efficient Benchmarking in Production: A Study of an Evolving LLM Agent


33. PlaceReasoner-Beta: Reasoning-Driven Macro Placement and Benchmarking


34. CogGym: Towards Large-Scale Comparative Evaluation of Human and Machine Cognition


35. A Fully Differentiable Neuro-Soft-Symbolic Framework for Perceptual Task Planning


36. Ability-Residual Decoupled Modeling for Affective Cognitive Diagnosis


37. Information-Gain Rewards over Diversity-Pruned Tests: GT-Anchored Verifier Co-Training for Reliable Code Generation


38. AI-GRACE: A Use-Case Operationalization Framework for Agentic AI: From Organizational Objectives and Obligations to Deployment Capabilities and Architecture


39. Implicit Rule Induction with Test-Time Task Embeddings in ARC-like Tasks


40. SpecOpt: Contact-Diff Reasoning for Agentic Molecule Optimization Toward Binding Specificity


41. Can Agents Design Better Chips with a Higher Level Abstraction?


42. Clinician-Grounded Quality Assurance for AI-Assisted Psychiatric Intake


43. TinyCeNN-LM: Quality-Gated Conversion of Pretrained Attention with CeNN-Inspired Cellular-Recurrent Layers


44. Decoupling Internal Representational Changes and Causal Importance in Fine-Tuned Large Language Models


45. Detecting Hallucination in LLMs: Tracing the Topological Signatures of Impaired Context Sharing


46. LoRA Enhanced Contrastive Learning with SAS Vision Transformers


47. CaLR: Causal Latent Revision for Robust Diffusion Reasoning


48. Attention-Aware Routing: Coupling Routing and Attention in MoEs


49. RBS-Attention: Radius-Bounded Sparse Prefill for Long-Context Large Language Models


50. Value-Sensitive Delegation in Everyday AI Agent Use: Evidence from OpenClaw


51. Gricea: An Open Science Platform for Conversational AI Research


52. DiaVLo: Diagnosing Behaviours of Vision-Language Models


53. Bayesian Belief Layer for Controllable Opinion Dynamics in LLM Agents


54. NemotronLabs VoiceChat: An Open Full-duplex Speech-to-Speech Model with Tool Calling Capabilities


55. When Should a Failing Robot Ask? Initiating Corrective Human-Robot Dialogue from Audited Sensor Evidence


56. Detecting Pretraining Data in Large Language Models from a Free-Energy Perspective


57. Benchmarking the Explanatory Quality of Open-Weight Vision-Language Models in Face Recognition


58. Neural Cellular Automata Learn General Features in their Hidden Channels


59. Do Personality-Tuned LLMs Make Better Social Agents?


60. Federated Deep Clustering Networks for High-Dimensional and Heterogeneous Data


61. Touvigation: Embodied Adaptive Object Acquisition for Blind and Low-Vision Users in Unfamiliar Indoor Environments


62. Matrix AdaGrad: Row-wise and Column-wise Adaptive Subgradient Methods


63. An Agentic Just-in-Time Adaptive Intervention System for Personalized Sleep Support: Proof-of-Concept Study with N of 1 Data


64. ForceTwin: Physics-informed Digital Twins for Robotic Manipulation from Instrumented Human Interaction


65. Balanced Prompt Adaptation against Entropy-Induced Collapse for Test-Time Binary Segmentation


66. CIBuzzBench: A Benchmark for Cross-Lingual Understanding of Chinese Internet Buzzwords


67. TERMon: Detecting Persistent Behavioral Threats in Edge AI via Hardware-Native Ternary Runtime Monitor


68. CIPL: A Channel-Aware Framework for Recoverable Privacy Leakage in LLM Agents


69. From Code Archival to Knowledge Graph: Bridging Software Heritage, COAR Notify and Wikidata


70. Samsone: A Family of Open Small Audio Language Models for On-Device Inference


71. When Steering Fails in Latent Reasoning: A Latent-to-Language Transition Gap


72. Outcome-Conditioned End-Effector Geometry Across Vision-Language-Action Policies


73. SynthDemo-RL: Breaking the Zero-Reward Barrier in VLA Adaptation with LLM-Guided Synthetic Demonstrations


74. Chinese Competitive Debating Dataset and Benchmark


75. Steering LLMs Responses Towards Moral Foundations on the Norwegian MFQ-30


76. Potential-Field Action Representation for Reinforcement Learning in Contact-Rich Manipulation


77. Micro-Collaborative Poisoning: A Distributed Attack on RAG Systems


78. CityLearn v3: A Configurable Simulation and Evaluation Framework for Realistic Control Studies of Renewable Energy Communities


79. GameLogicBench: Evaluating Coding Agents on Runtime Game Logic with Tick-Level State Assertions


80. On Repulsive and Attractive Teachers: Separating Correctness from Behavior in Self-Distillation


81. OneBid: A Unified Auto-Bidding Foundation Model for Diverse oCPX Advertising Scenarios


82. VidOmni-Bench: A Benchmark for Fine-Grained Video Understanding via Spatio-Temporal Event Verification across Complexity and Duration


83. 2nd Place Solution to the HANDS 2026 Workshop Challenge-Dexterous Grasp Motion Track: Single-Shot Trajectory Warping for Grasp Motion Generation


84. HE-Guardrail: A Homomorphic Guardrail Against Jailbreak Attacks for Encrypted Large Language Model Inference


85. OmniVChat: Synthesizing, Benchmarking, and Training for Native Audio-Visual Dialogue


86. AtomEgo: Exploring Ego-Robot Integration for Embodied Foundation Model Pretraining


87. Interference-Driven Clustered Optimisation for FM Spectrum Coordination


88. Think Locally, Refine Globally for Memory-Efficient 3D Reconstruction


89. Talking Past the Machine: Morality, Politeness, and Alignment in Human-AI Dialogue


90. WS-NeRF: A Mamba-Driven World-State-Aware Adaptive Deblurring Neural Radiance Field


91. Consistent Relexicalization of Clinical Documents using Graph-Based Approach


92. AgentVidBench: A Multi-Hop Video Question Answering Benchmark for Evaluating MLLM Agents


93. Knowledge-Graph-Augmented Chronos-2 for HEC-RAS Surrogate Forecasting


94. From Memory to Behavior: A Behavior-Aware Role-Playing Framework for Social Media Influencers


95. CESBench: Benchmarking Large Language Models on Cryptographic Engineering Security for IoT Devices


96. Co-Evolving Zero-Day Jamming: Adaptive Attack Synthesis and Graph Attention-Based Online Detection


97. Deep Reinforcement Learning with Buffered Quantile Objectives


98. Authorization Revocation for Long-Running AI Agents: Root-Scoped Quiescence under Delegation and Asynchronous Execution


99. Beyond Exact Match: Task-Aware GRPO for Cross-Domain PCBA Visual Question Answering


100. Verify, Don’t Trust: Agentic Model Development for Video Discovery Retrieval at Scale


101. VLA-Scope: Shift-Aware Failure Prediction for Vision-Language-Action Models


102. KnowDemo: Knowledge-Guided Robot Demonstration Generation from Human Videos


103. FOCAL-VLA: Subtask-Guided Geometry Distillation and Implicit World Modeling for Vision-Language-Action Models


104. Hallucination-R1: Robustness-Oriented Paraphrase Generation for Factual Consistency


105. Fewer Steps, Better Actions: Rethinking Flow-Matching Inference for VLA Policies


106. Visual Navigation Transformer with Pose Attention


107. SWE-Proof: Can Language Models Resolve Real-World Issues with Machine-Checked Proofs?


108. EnSol: an environment-aware graph neural network for molecular solubility prediction


109. The Stochastic Shift: A New Evaluation Paradigm for Text-to-SQL with AI Operators


110. From Task Success to Productive Success: Evaluating Human-AI Collaboration by Quality and Cost


111. Geometry of Values: Task Vector Composition for Ethical Preference Alignment in Language Models


112. Aligning with Lived Experience: Heterogeneous Benefits of Fine Tuning in Mental Health Support Generation


113. PlantShade: Predicting Plant Shadows for Lighting-Aware Robotic Agricultural Operation


114. How Much of a Real Workload Can LLM-Generated GPU Kernels Actually Reach?


115. Physically Based Rendering in the Latent Space


116. Scaling Discovery through Test-Time Communication


117. Trustworthy FinAInce: Unpacking How AI-Mediated Financial Advice is Judged


118. Bio-MF: Low-Latency and High-Fidelity EEG-to-fNIRS Cross-Modal Generation for Hybrid Motor-Imagery Brain–Computer Interfaces


119. SpaceDiffusion: Over-the-Orbit Diffusion for Space Generate-and-Forward Communications


120. BI-Agent and BI-Bench: Towards Automating End-to-End Business Intelligence


121. Reinforcement learning for post-coronagraphic wavefront control


122. Making Latent Evolution Explicit: Operator-Structured Transitions for World Action Models


123. A Hybrid Computational Intelligence Framework for scRNA-seq Imputation: Integrating scRecover and Random Forests


124. dSTAR: Straggler Tolerant and Byzantine Resilient Distributed SGD


125. ResNLS: An Improved Model for Stock Price Forecasting