전체 AI 논문 - 2026-09-14

1. Rethinking Heterogeneous System Disaggregation for Subquadratic Attention


2. A Hybrid LSTM-XGBoost Framework for Multi-Horizon Stock Return Prediction Across Diversified Equity Portfolios


3. CMA-OT: Hierarchical Expert Supervision for Dance-to-Music Generation


4. Embodied-BenchForge: A Closed-Loop Agentic Workflow for Embodied Benchmark Construction


5. Autonomous Research for Open-Ended Problems: A Case Study on Telecom Ticket Retrieval


6. Anchoring Clinical Events in Time: UID-Preserving Multimodal Reconstruction and Source-Grounded Adjudication


7. Diffusion Models and Concept Formation


8. How Good Are Frontier Models at Physics? Expert Re-Grading Reveals Broken Evaluations and Near-Saturation of Leading Benchmarks


9. EduFair-Bench: Evaluating Pedagogical Fairness of LLM Tutors Across Student Demographics


10. Tracing and Coordinating Cross-Layer Influence for Multimodal Model Merging


11. MedRoundsQA: A Persona and Difficulty Aware Evaluation for Multi-Turn Medical Consultations


12. Scaling Clinical Judgment to Evaluate Medical AI


13. K-Bench: A Benchmark for LLM Unlearning in Agentic Deployments


14. Interpreting the predictions of neural network classification based on a Taylor Coefficient Analysis (TCA)


15. MPT: Missing Prototype Tracking via Barycentric Reconstruction in Vehicular Federated Learning


16. Unified Agentic Video Editing Across Levels of Complexity and Creativity


17. SCQ: Stabilizing Conservative Q-Learning with Sigmoid-Bounded Entropy


18. Assisted Spatial Cognition Through Vision-Language Models


19. What Drives Recovery in Agentic Text-to-Cypher? LAST-CQ: An LLM Agent Self-Refinement Framework


20. Skill Issue: Lessons from Optimizing Repository SKILLs for Coding Agents


21. When Rubrics Fail: Hallucinations Reveal Blind Spots in Medical AI Evaluation


22. Implicit Personality Representations in Humans and LLMs


23. Enabling and Understanding Personalization in AI-Generated Advertising Imagery


24. I Am AdMan: A Pipeline for Automatic Generation of Personalized Advertising Imagery


25. Residual Vector-based Reconstruction as Long-Context Recall Regardless of Context Window Size


26. Generative AI Use Cases In Real Estate Marketing: Adoption and Constraints in Germany


27. SteerDuplex: Steerable Duplex Speech Dialogue Models


28. Beyond Generation and Accuracy: Diagnosing and Enhancing Visual Chain-of-Thought for Geometry Problem Solving


29. Reproducing and Evaluating the Generalizability of Subliminal Learning in Open-Weight Models


30. From Collaboration to Capability: Internalizing Routed LLM Experts into Compact Reasoners


31. Information Specialization and Constrained Synthesis in Multi-Agent LLM Forecasting: A Prospective Live-Study of the 2026 FIFA World Cup


32. Confidence-Gated Transductive Test Generation for Code Reranking


33. When Does AI Augment Work? A Workflow-Level Framework for Human-Agent Collaboration


34. TripPattern: A Pattern-based Text Watermarking Method for Large Language Models


35. Beyond Vector Similarity: Hierarchical Context-Aware Graph RAG vs Standard RAG in Enterprise Code Migration


36. EvoRS: On-Policy Self-Evolution of Reward Systems for Open-Ended Reinforcement Learning


37. Do LLMs Trust the Accuser or the Accusation? Measuring Belief Shifts in Werewolf


38. LifeFuse-Mem: Lifecycle-Aware State Fusion Against Temporary Overwriting for Long-Term Memory


39. Hierarchical Belief Modeling for Zero-Shot Opponent Adaptation in Partially Observable Multi-Agent Navigation


40. SoK: Rethinking Jailbreaking in the Era of Agentic AI: Attacks, Defenses, and Practical Consideration


41. VRL-Bench: Benchmarking agents on computer control tasks under finite trial budgets


42. Beyond ID Embeddings: Process-Grounded Language Modeling for Cognitive Diagnosis


43. Decentralized Evolution of Hexapod Gaits with Independent Leg Controllers


44. OneLA: Scaling Linear-Attention Decoding to Large Beams in Generative Recommendation


45. Niching Agents in The Core


46. Is Gaussian Splatting Becoming Neural Again? A Taxonomy and Controlled Study of Learned Parameterization


47. BlueLM-GUI Technical Report: A Real-Device-Centric Flywheel for Self-Improving Mobile GUI Agents


48. Toward Robust Personalized Alignment for LLMs: Mitigating Persona Drift in Multi-Turn Dialogue


49. LoRA-RC: Reservoir Computing with Low-Rank Adaptation


50. Affective Agent: On-Device Personalized Intervention Reasoning for Wearable Systems


51. AIM: A Privacy-Aware Interoperable Memory Framework for Multi-Agent Multi-User LLM Systems


52. Do Influence-Derived Data Perturbations Enable Machine Unlearning? A Controlled Study of Three Plausible Roles


53. Hybrid Physics-AI Framework of Body Center of Mass Dynamics from Wrist-Worn Sensors


54. Robust Prototypical Networks for Few-Shot Sensor Fault Diagnosis


55. T-GADE: Thermodynamical Generative-AI-Driven Evolution of LLM Artifacts


56. Learning Symbolic Constraint Representations from Examples: A Neuro-Symbolic Approach


57. GTA: Graph Theory Agent and Benchmark for Algorithmic Graph Reasoning with LLMs


58. Soft Symbol Grounding for Prototypical Concepts


59. WinSyn: An Automated Pipeline for Realistic Enterprise Question-Answering Evaluation


60. GLARE: Generative Learning via Adversarial Reward Estimation For Social Dynamics Forecasting


61. Can LLMs in Draft-Verify-Revise Pipelines Resolve Deictic Ambiguity?


62. Mined from Scientific Literature: Process Schemas for Atomic Layer Deposition and Etching in Materials Science


63. When Successful Knowledge Graph Edits Displace Correct Answers: Rank-Level Locality beyond Parameter Support


64. DU-NO: A Parameter-Efficient Double U-Shaped Neural Operator for Phase-Resolving Wave Modeling


65. Language Is an Insufficient Substrate for Quantitative Reasoning, and Consequential Domains Need Large Quantitative Models


66. Competence-Gated Pooling of Language Models and Priors for Event Forecasting


67. Reading the Whole Heart: Latent-Attention Masked Autoencoders for Multimodal Cardiac Representation Learning


68. Harness or Model? Isolating the Harness Effect in Agentic Coding with a Contamination-Controlled Private Suite


69. Occamy-1.0: Open Pareto-frontier 35B Intelligence for Co-work


70. ASTRIL-MPC: Autonomous Traversal Framework of Articulated Tracked Robots with Language-Guided Neural-Kinematic MPC


71. MP-Bench: Evaluating Voice Agents as a Multiparty Conversation Participant


72. MAxBench: A Multinomial Concept Recovery Benchmark


73. Involving before Evolving: A Vision for Trustworthy Enterprise Digital Twin Engineering


74. Dynin-Robotics: Omnimodal Unified Diffusion Vision-Language-Action Model


75. Unified CT and MRI Pancreas Segmentation for Label-Efficient Cross-Modality Subregion Transfer


76. DynSHAP: Towards Explainable Dynamic Survival Analysis


77. Groupoid-Based Internal State Representations for Reinforcement Learning with Local Symmetries


78. Attention Quantization for Tabular Foundation Models


79. Label-Guided Knowledge Distillation for 3D-CNNs in Action Recognition


80. TileNet: Tile-Based CNN-SVM Architecture for Autonomous Unmanned Aerial Systems Inspection of Flat Roofs


81. Comfort by Construction: Adaptive, Comfort-Bounded Action Spaces for Learned Driving Policies


82. Tasks over Application Manuals: Revealing Gaps in Long-Horizon Procedural Reasoning for Language Models


83. SeqMoE: Toward Full-Load Performance via Predictive and Graph-Compatible MoE Offloading



85. ARC: Autonomous Robotics Compliance A Three-Layer Governance Architecture for Deployed Autonomous Systems


86. LLM-Enhanced Dual-Branch Learning for Large-Scale Multi-Label Text Classification


87. UniPart: Towards Zero-shot Language-Grounded 3D Part Segmentation for Embodied Interaction


88. Behavior Quotient Learning for Low-Rank Adaptation of LLM Agents


89. Large Distant Gradients Need Not Be Reliable: reliability-weighted credit assignment for long-horizon autoregressive forecasting


90. A Multi-Vehicle Dataset with Camera, LiDAR, and Radar Sensors and Scanned 3D Models for Custom Auto-Annotation using RTK-GNSS


91. 3D CT-to-PET Translation via Latent Brownian Bridge Diffusion


92. A Graph-Based Approach for Mapping Kernel-Level Telemetry to MITRE ATT&CK


93. Evaluating Context Segmentation in Locally Deployable SLMs for Cybersecurity CTF Tasks


94. Online Video Agent Harness for Long Video Understanding


95. 4D Parallelism Unlocks Exascale Bayesian Neural Networks for High-Fidelity Atmospheric Modeling


96. RunningTensor: Generalizing Linear Attention to Higher-Order Recurrent States


97. Cognition on Graph: Navigating Massive Knowledge Space via Cognitive Cycles and Bidirectional Graph-Text Synergy


98. GraphAHA: Graph-Based Adaptive Search with Heterogeneous Actions for Test-Time Code Generation


99. Supermartingale Certificates for Parametric MDPs


100. InRTL: Effective Intra-Inter Interaction Learning for Relational Tables


101. What is the Difference Between Me and You? Benchmarking the Quality Gap Between Human-Written and AI-Generated Code


102. Separating Engineering Reasoning from DEXPI Serialization in LLM-Based Greenfield Surface-Process Design: A Three-Case Study for Underground Gas Storage


103. Explaining Time Series Forecasting with Horizon-Resolved Attribution


104. Correlation-Guided Fast Machine Unlearning via Hessian Analysis


105. ResoSeg: Resonance Tagger using Transformer and Segment Model


106. Direct Preference Density Alignment for Conversational Audio Equalization


107. SIMS: Scale-Invariant Merit-Function-Based Scalarization for Multi-Task Learning


108. Clustering-Based Balanced Sampling and Allocation with Data Parallelism for High-Performance Fine-Tuning


109. SCOPE-OPSD: Fisher-Conditioned Privileged Subspaces for On-Policy Self-Distillation


110. Calibrated Ambiguity in Multimodal Language Models: Humans reach for cultural references, while models describe the picture


111. TokenMapper: A Step Toward Interoperable Speech Token Translation


112. RoofLang: Enabling AI-Driven Architecting of LLM Inference Systems


113. Meddies-PII: A Multilingual Framework for Personally Identifiable Information Extraction in Clinical De-identification


114. Earth-Agent-Pro: Towards Real-World Full-Chain Earth Observation with Agents


115. Optimizing Geoengineering Interventions Using Differentiable Climate Models


116. Computing at Sea: Floating and Offshore Data Centres as a Pathway to Sustainable AI Infrastructure


117. LettuceVisSim: A Simulator That Generates Lettuce Image Time-series for Vision-Based Reinforcement Learning


118. Adaptive Agent Design


119. Not All Speech Is Intent: Adaptive Self-Correcting Inference Layer for Post-ASR False Wake-Up


120. Linear Exponential Quadratic Gaussian Covariance Steering


121. Bridging Vision Foundation Model Priors with CLIP for Spatial-aware Few-shot Anomaly Detection in Medical Images


122. 3D Digital Twin Visualization of Multiclass GRF-Based Gait Disorder Classification


123. IMPLY: Physically Anchored Consistency for World-Model Rollouts


124. Debiasing as a Measurement Intervention: Calibrated Ties and Resolution Loss in LLM-as-a-Judge Evaluation


125. Beyond the Query: Do Retrieval Signals Improve Adaptive Multimodal RAG Routing?


126. Observation-Anchored Selective Assimilation for Longitudinal Tumor-State Proxy Forecasting in Post-Treatment Glioma


127. MInTRL: Off-policy Intervention can boost On-policy RL


128. UFO: Chain-of-Evaluation for Omni-Condition Alignment in Multi-Modal Image Generation


129. RF-VoID: Towards Bandwidth-Efficient Exterior Tile Void Detection via Narrowband Radio-Frequency Representation Learning


130. ORQA: An Occupation-Realistic Question and Answer Framework for LLM Professional Knowledge


131. ESTS at WMT26: Routing-Informed Expert Pruning for Model Compression


132. Self-Verifying Anomaly Detection using Explainable AI for Cybersecurity of DER Networks


133. Breaking the Token Ceiling: Distilling Smaller, Stronger Byte Models


134. Amortized Low-Rank Adaptation for Model-Based Reinforcement Learning


135. Reinforcement Learning over Patient Trajectories for Clinical Reasoning in EHR Foundation Models


136. Recommendation Retrievers Need Verifiers: Universal Generative Reranking for Sequential Recommendations


137. HypoKG: Evidence-Disciplined Biomedical Hypothesis Generation Beyond Endpoint Knowledge



139. DriftSE: Speech Enhancement with Generative Drifting


140. Chopthin-Consensus Power Sampling: A Diversity-Preserving Approach to LLM Decoding


141. Learning to adapt GR(1) specifications through degradation


142. Repair Before Reinforce: Context-Augmented Knowledge Graph Reasoning for Multi-Hop Question Answering


143. Predicting Collision Cross Sections with GRACE: Geometric Residual Adduct Conditioning via Early-fusion


144. QuPAINT: Physics-Aware Multimodal Reasoning for Quantum Material Characterization


145. Retrieval-Augmented Generation for Scientific Code Understanding


146. Agentic TCAD Calibration Workflow for Oxide Semiconductor Transistors


147. Explanations-Driven Active Feature Acquisition for Algorithmic Recourse


148. NDT Factory: Synthesizing Verified Network Digital Twins from Semantic Models via Multi-Agent LLM


149. USPLIT-VQA: U-Shaped Split Learning for Visual Question Answering with Contribution-Aware Weighted Aggregation


150. A decision-basis contract for auditable LLM-assisted medical billing verification: deterministic rules, verbatim evidence, and fail-closed abstention


151. Neural Multichannel Distant Speaker Diarization with Heavy-tailed Source Separation Model


152. The Anatomy and Boundary of Adaptation under Temporal Tabular Shift


153. Extracting Dataset Mentions in Forced Displacement and FCV Documents: A Weakly Supervised Framework with LLM-Based Label Refinement


154. MAIA: Multi-Agent Intent Articulation for Requirement Discovery in Art Commissions


155. Creating an Atomic User Model for Personality-Aware Large Language Model Interaction


156. Hierarchical Prototype Emergence in Modern Hopfield Models


157. Reality Is the Final Verifier: On Two Key Gaps in Agentic Software Engineering


158. Pelican-Sim 1.0: A General World Model Simulator for Embodied Intelligence


159. Continuous Learning of Gravity Field Irregularities Around Small Bodies via Neural Hamiltonian ODEs


160. When Agent Metrics Measure Different Things: An Evidence-Grounded Audit of the Praxa AI Pipeline


161. Can We Trust LLM Judges: A Study of Capability-Dependent Biases and Multi-Judge Ensemble for Bias Calibration


162. Assessment of Non-Institutional AI Tool Usage Among Clinicians


163. Who Pays for Open Review? Visible Author Reputation and Its Effect on Ratings


164. PRISMA-LLM: An Empirical Reporting Framework for AI-Assisted Systematic Reviews


165. SoulAuth: An Actor-native Identity Architecture and Rust Reference Implementation for Humans and Long-lived AI Actors


166. AI Safety: Not Optional, Not Later


167. Robust Trust