전체 AI 논문 - 2026-09-10

1. JarvisGUI: Towards Cross-Device GUI Agents with Dynamic Task Composition


2. ConvMem: Convolutional Memory for Long-Context Reasoning


3. Fortunate Recall: Ontology-Driven Memory Lifecycle Management for Persistent Coherence in LLMs


4. Cyber-Financial Contagion: Modeling the Propagation of an AI Vendor Compromise Through the Banking System


5. From Symbolic Perception to Logical Deduction: A Framework for Guiding Language Models in Geometric Reasoning


6. TRACE: Training Reasoning Agents for Causal Exploration with Synthesized Rewards


7. What Should an Agent Forget? Separating What Is Stored from What Is Used


8. Why Sample What You Can Enumerate? Exact Policy Optimization for Genomic Tool Selection


9. Beyond Surface Imitation: Contrastive Modeling for Reasoning Path Alignment in Multimodal In-Context Learning


10. Kernel-Managed Shared Memory for System-Wide Personalization


11. Agent-Based ML-LLM Fusion with Self-Optimizing Prompts for Plateau Weather Alerts


12. RAP: Research Attention Prediction Reveals Target-Conditioned Evidence Acquisition Biases


13. Reference-Based Bias Detection in LLMs via Relative Representations of Hidden States


14. OntologyAligner: Ontology-Aligned Retrieval and Hierarchy-Guided Large Language Model Reranking for Biomedical Ontology Normalization


15. Belief-State Engine: Augmenting LLMs for Principled Planning Under Partial Observability


16. Structural Process Supervision for Latent Chain-of-Thought Reasoning


17. Time-Frequency Geometric Cross-Attention for Chunked Vision-Language-Action Models


18. Grounded Evaluation and Repair for NL-to-PDDL Problem Generation


19. Decision Transformer for UAV-Mounted RIS-Assisted Dynamic D2D Communications


20. Scored vs. Generated Readouts in Behavioral Language Models: An Empirical Study of Elicitation Format


21. AgentAudit: An Open, Extensible Framework for Full-Lifecycle Trust Evaluation of AI Agents


22. Shifting Relational Paradigms for Affective Computing: Affective Resonance, Vitality Affects, and Vocal Interaction Fields


23. The Era by Eon Benchmark: A Generated Enterprise Estate with Exact Ground Truth for Benchmarking LLM Agents


24. UnitBoost: Managing Compound LLM Systems with a Merge Operator, Not a Model


25. Proof-Carrying Cognition: Closing the Verification Gap with Reality-Settled Reward


26. Procedural Memory Under Change: Reuse and Interference in Controlled Web Tasks



28. Can Artificial Intelligence Support Healthcare and Mental Health Through Early Cyberbullying Detection ? The Impact of Emotion-Aware AI on Proactive Online Safety


29. Which Tokens Should SFT Actually Learn? A Token-Trimming Perspective on Mathematical Reasoning


30. Decision Shifts, Lost Label Functionality, and an Inconclusive Grounding Audit in Correctness-Gated Multi-Teacher Distillation


31. Safe to Stop? Risk-Constrained Stopping for Sequential Clinical Diagnosis Agents


32. PRAGMA: Evaluating Personalized Guidance with Memory Alignment in Lifelong Conversations


33. RESCUE-BENCH: Towards Relation-Aware Multi-Party Emotional Support Conversation Systems


34. Black-Box Red Teaming of Agentic AI: A Taxonomy-Driven Framework for Automated Risk Discovery


35. RobustSGPO: Search-Space Control for Agent Harness Evolution


36. Seven Sources of Physical AI Capability Formation


37. From State Synchronization to Cognitive Self-Evolution: An Operational Architecture for Cognitive Digital Twins


38. A Function-Space Approach to the Statistical Mechanics of Learning Dynamics


39. CityPlanner: A Sandbox Agent for Executable Urban Planning


40. Multi-Agent Agentic Graph Learning via Structural Signatures


41. ContractEval: Query-Conditioned Execution Matching for Procedural Instruction Conformance


42. Do Agents Know When They Succeed? Calibrating Agent Confidence from Internal Representations


43. XAI-Arena: Can LLMs Assess the Quality of XAI Explanations?


44. Valerant: An Automatic Navigable Game Map Generator via Action-Conditioned World Model Exploration


45. Decision-Focused Active Learning for Scale-Aware Critical-Materials Recovery


46. The Menu Is an Execution Prior: State-Path Tool Menus for Online Agents


47. An Autonomous GeoAI Agent for Arctic Eco-Navigation


48. Gradland: On Phenomenal Experience, Differentiated Across Many Dimensions


49. Subagents vs Agent Skills: Executing Reusable Knowledge for Long-Horizon Agentic Tasks


50. Adaptive Entangled Game Modules in Artificial General Intelligence


51. OpenDiscoveryTrace: Process Traces for Evaluating AI Scientist Workflows


52. Show-Harness: Just a VLM Agent Can Play Robots


53. IBIB: A Protocol for Measuring Enterprise AI Systems by Serving Route, Not Model Identifier


54. Semigroup-JEPA: Latent Dynamics Consistency for Zero-Shot Physics Generalization


55. Forgetting Only What Matters: Layer-Selective Unlearning toward Robust LLMs


56. Emergency Department Revisit Quality Review Screening: Exploring Human Decision-Making and Artificial Intelligence Support


57. Can Foundation Models Moderate Online Content? Evaluating Instruction- vs. Example-Driven Policy Operationalization


58. MOONWALK: Mediating Operations with Intent-Evidence-Action Alignment Across Junior-Supervisor Review Workflows in Animation/VFX Pre-Production


59. PACE: Perceived-Latency-Aware Cascading Service Routing and Filler Control for QoE-Efficient Retrieval-Augmented Dialogue Serving


60. OmniMed-FL: A Robust Multimodal Federated Learning Framework for Clinical Diagnosis


61. Beyond One-Size-Fits-All: Sample-Adaptive Strategy Routing for Vision Token Pruning in MLLMs


62. One Loop, Two Gains: Can Active Learning win the Lottery for Free?


63. RiLM: Parameter-Efficient Language Modeling via Geodesic Decoding


64. Learning Intrusion Response Strategies for OT Systems



66. DiSCo: A Distribution-First Steering and Cultural Prior Evaluation Framework for Measuring Cultural Preference Bias in LLMs


67. A-JIT: Agentic Just-In-Time Software Construction


68. LiteRAG: Cost-Efficient Graph-Based Retrieval-Augmented Generation



70. Can AI Agents Deliver Verifiable Network-Wide Outcomes Across Authority Boundaries?


71. Active Adaptation, Not Static Defense: Temporal Dynamics of Preventative Steering in Adversarial Fine-Tuning


72. Context operations to architecture modelling output from large language models and evaluation criteria for their use in systems engineering design


73. SA-Profile: Automated Sulcus Angle Profiling from Super-Resolution MRI


74. A Trust-Network-Based Federated Learning Framework for Multi-Center Aging Clock Prediction


75. Beyond Training: A Feasibility Taxonomy for Inference-Time AI Governance


76. A statistical approach to bias in zero-shot learning: the lens of handwriting recognition


77. NOPE-HYPE: A Structured Simulation Workflow for Robust Speech-to-Text Across Diverse Acoustic Environments


78. Direct Diversity Optimization for Diverse Successful Trajectories in Preference Post-Training


79. Elastoformer: Enabling Dynamic Adaptivity via Elastic Model Transformation


80. MetroLLM-Bench: Evaluating Language Models as Transit Kiosk Runtimes


81. What Makes Adversarial Examples Transfer Across Deepfake Detectors?


82. Fidelity-Aware Scheduling of Quantum Circuits on Multi-QPU Systems


83. Improving Cross-Lingual Token Representations by Adding a Pinch of SALT


84. FlowCPO: A Unified Divergence View of Preference Alignment for Flow Models


85. Strangers to Themselves: What Language Models Say About Themselves Is Generic


86. Albedo Estimation via Latent Bridge Matching


87. Forward-Free LLM Depth Pruning via Weight Redundancy


88. With a Thermomix You Lose the Ability to Cook: A Kitchen Machine Analogy for Applications of Generative AI in Education


89. Can AI Agents Detect and Repair Artifact Drift in Network Experiments?


90. Subgroup Membership Inference Audits of Differentially Private Synthetic Text


91. uFlowCSP: Crystal Structure Prediction using Mean flow generative models


92. CS-Guard: Benchmarking LLM Guardrails for Code Generation Security


93. How Fragile Is Safety Alignment at Frontier Scale? A Single-Direction Attack on a 320B MoE


94. LogiScope-VQA: Benchmarking Vision-Language Models for Logistics Hazard Identification in Industrial Scenarios


95. Pairit: A Platform for Live Experiments on Human-AI Collaboration


96. BRACE: Anchored Bellman-Residual Correction for Stale Critics in Asynchronous RL


97. Fine-Tuning a KV Cache Concatenation-Aware Model or Recomputing KV Caches? Why Not Both?


98. HiRAD: A Flexible Large-Scale AGV Routing System


99. Distilling Image Prototypes for Guided Test-Time Adaptation


100. Kernel-Complexity Edge Sanitization for Training-Free Defense against Structural Graph Attacks


101. When Auditors Fabricate: Batch-Size Degradation and Confident Hallucination in LLM Detection of Planted Document Contamination


102. CT-SAFR: Safe and Interpretable Chain-of-Thought Reasoning for Autonomous Robots: A Multi-Layered Verification Framework for Trustworthy AI-Driven Robotic Decision Making


103. Looped GPT-BERT: Trading Parameters for Computation in Small Language Modeling


104. Which Medical Questions Deserve Rationales? Perturbation-Sensitive Selection for Robust QA


105. Introducing Consort: A Spec-First Agent Framework for Enforced, Test-Driven Development on Live Database Branches


106. Cascading Gradient Inversion via LT-Code Inspired Peeling in Federated Learning


107. Hyperbolic Geometry for Open-World Object Detection in Remote Sensing Imagery


108. RouteBridge: Reliability-Routed Bidirectional Distillation Between Neural Radiance Fields and 3D Gaussian Splatting


109. Watermarks Without Verification: AI Text Watermarking After the EU AI Act


110. Compact Visuotactile World Models for Lifting: Prediction, Reward Alignment, and Force Constraints


111. Teacher Geometry Shapes Learnability in Teacher-Student Networks


112. Modality-Decoupled Federated Learning for Privacy-Preserving Embodied Intelligence in 6G


113. Myocardial Strain Drift Correction in Deep Learning Based Ultrasound Tracking


114. Learning with Synthetic Data via SGD in High-Dimensional Linear Regression


115. The Vibe Shift in Software Engineering: Evaluating AI-Led Conversational Programming for Performance, Cognition, and Responsible Adoption


116. High-probability guarantees for linear accessibility in feature superposition


117. Arbitrary Cipher Attacks Against Large Language Models Do Not Require Fine-Tuning


118. A Statistical Approach to Estimating Sample Size of Machine Learning Models


119. Adaptive Distributed Physical-Layer Authentication and Attack Detection in 6G Non-Terrestrial Networks via Causal Meta-Learning


120. From Fixed Keys to Readable Schemas: Small Language Models for Vehicle Agent Function Calls


121. Distributed Physical Layer Authentication and Collaborative RSMA in Non-Terrestrial Networks via Graph Reinforcement Learning


122. Efficient Leakage-Free Neural Architecture Search under Leave-One-Subject-Out Evaluation


123. SCCM : Stream Cruise Control Method for Automated Drift Detection and Adaptation


124. Edu-QuRating: Multi-Dimensional Educational Data Curation with Distilled Pairwise Judgements


125. Reliable Near-Field Multi-User Positioning Informed by Two-Stage MUSIC


126. An Experimental Evaluation of Multimodal Prompt Injection Attacks on Agentic AI Frameworks


127. VANTAGE-Bench: Evaluating the Infrastructure AI Gap in Vision-Language Models


128. Auditable Emergency Triage for Maternal and Newborn Care in India


129. Smart Adaptive Computing Across the Continuum: LLMs in IoT-Edge-Cloud Resource Management


130. Improving 5G AI-RAN MCS Selection by Predicting Retransmissions


131. Support Discovery With Iteratively Reweighted Least Squares for Fixed-Charge Network Flow


132. Voice or Stereotype? Disentangling Acoustic and Content-Based Gender in Speech-to-Speech Models


133. DiffLUT-Net: Differentiable Training of FPGA LUT Networks with Learnable Connectivity


134. No Free Checker: A Survey of Verifiers for Robot Policies


135. What Fixed-Rollout pass@k Evaluations Can Identify


136. Critical initialization destabilizes higher input derivatives in wide scalar-input networks


137. In RAG We Trust? Measuring Robustness of Retrieval-Augmented Generation Under Document Poisoning


138. Talking to Itself While Coding: What Makes Comments Help Code Generation?


139. Distribution-Consistent Inference for Dynamic Sparse Mixture-of-Experts


140. Scaling Post-Training Ternarisation to Qwen3-8B Capability Retention, Reproduction, Lossless Packing, and Packed Execution


141. Compute-Bounded Security Assurance - Coverage, Verification, and Response under Resource Constraints


142. Scores Alone Do Not Prove Discovery: The Discovery Certification Protocol for Auditing AI Research Agents


143. Geometry Conditioning in an Embodied SLM: Training Controls and Robustness Diagnostics in a 0.8B Hybrid Model


144. AgentHijack: Visual Patch Attacks on Multimodal Computer-Use Agents


145. Reliability-Aware Hybrid-K Ensemble Selection for Cervical Cytology Classification: Integrating Discrimination, Calibration, and Selective Prediction


146. AgenticGen: Reward-Guided Agentic Video Generation for Advertising


147. Trust Me, I’m Your Developer: Self-Issued Authentication in Large Language Models


148. Characterizing Text Branch Sensitivity in Medical Vision-Language Segmentation via Evidence Decoupling


149. From Plausible to Actionable: A Position on LLM Self-Explanations


150. Quantifying Logical Consistency in Transformers via Query-Key Alignment