전체 AI 논문 - 2026-07-14

1. Playful AI in Professional Email: A Field Experiment on Tone and Recipient Engagement


2. Think Through a Bottleneck: Hourglass Reasoning for Rigorous Induction


3. Reproducing human biases in route choice using large language models: Toward scalable behavioral modeling


4. Lesioned Multimodal Language Models Reproduce Aphasic Picture-Naming Patterns


5. Auditing the Risk Claims of Distributional Reinforcement Learning


6. Interaction Scaling: Grounding the Third Axis of Test-Time Compute


7. MAGIC: Transition-Aware Generation of Navigable Multi-Scene Game Worlds with Large Language Models


8. HCRMap: Pressure-Aware Hot-Expert Residency Mapping for 3.5D MoE Chiplet Inference


9. Learning Residual Kinematic Corrections for Continuous Neural Decoding via Reinforcement Learning


10. Comparative Analysis of GAT and BERT for Human-Like Playtesting


11. Enhancing Query Efficiency for d-DNNF Representations Through Preprocessing


12. The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning


13. Omni-Decision: A Progressive Evidence-State Agent System for Omni-Modal QA


14. StructAgent: Harness Long-horizon Digital Agents with Unified Causal Structure


15. OpsMem: Dual-Memory Reasoning with Cross-Memory Resonance for Failure Diagnosis


16. From Neural Network Decisions to Training Cases: An Exact Account via Case-Based Decision Theory


17. Compile, Then Page: Executable SOP Programs and a Capability-Gated Runtime for Procedural LLM Agents


18. AutoVSR: Automatic Visual-to-Symbolic Reasoning for Symbolic Expression Generation from Circuit Schematic


19. Verifier-Guided Twelve-Tone Composition: A Generate-Verify-Repair Harness for Symbolic Music Generation


20. Calibrated e-CUSUM Decoding for Quantized Reasoning Models: Why Token Log-Probability Is the Wrong Observable for Decoding Monitors


21. Efficient Test-Time Optimization for Multi-Agent Proof Autoformalization


22. Valid $\ne$ Necessary: Diagnosing Latent Inefficiency in Chain-of-Thought


23. Bringing Back Rule Induction to Fluid Intelligence Research? An Initial Validation of the ARC-AGI Benchmark in Humans


24. Heterogeneous Agent Cohorts for Safe Open-Ended Exploration with Runtime Constraint Memory


25. PREF-Gate: Provenance-Constrained Relational Evidence Fusion with Validation-Gated Selection for Graph Fraud Detection


26. What We Talk About When We Talk About LLM Planning: Evidence for Two Distinct Planning Abilities


27. SCALECUA: Scaling Computer Use Agents with Verifiable Task Synthesis and Efficient Online RL


28. The Path to Self-Evolving Clinical Systems: Scaling Medical Agents from Assistance to Autonomy


29. STAMP: Provenance-Guided Credit Assignment for Deep Search Agents


30. The Hidden Footprint: Making Storage a First-Class Metric for LLM Agent Evaluation


31. NextFund: A Unified Performance Tracking Platform for Agentic Portfolio Management


32. A Formal Hierarchical Architecture for Agentic Orchestration with Stack-Based Execution and Lazy Discovery


33. OS-Pruner: Pruning Chains-of-Thought of Reasoning Models via Optimal Stopping


34. NVAITC AI Scientist: A Governed End-to-End Research System – A Hypertension GWAS Case Study


35. Are LLMs Ready for Scientific Discovery? A Capability-Oriented Benchmark for AI Scientists


36. AdvNav: Behavior-Guided Black-Box Adversarial Attacks on Vision-Language Navigation


37. QwenPaw-Data: Bridging Facts, Methodology, and Execution for Autonomous Enterprise Data Analytics


38. From Checker to Forecaster: Code-Owned Evaluation of Model-Generated Strategic Routes Under Delayed Ground Truth


39. SVR-R1: Bootstrapping Multi-modal Reasoning with Self-verification in Reinforcement Learning


40. Learning Linear Temporal Specifications from Demonstrations with Uncertainty


41. Incremental Transformer for Surrogate-Based Inverse Design of Geopolymer Mixtures


42. SETA: Scaling Environments for Terminal Agents


43. First-Order Modal Logic in HOL: Deep and Shallow Embeddings with Automated Faithfulness (Extended Preprint)


44. LOGOS: A Living Logic for AI Agent Teams That Evolve With Humans


45. Toward Contemplative LLM: A Modular Framework for Evaluating and Enhancing LLM Alignment in Mental Health


46. Route, Communicate, and Reason: Gated Routing and Adaptive Depth for Efficient Multi-Agent Reasoning


47. STEC: Evidence Compression for Deep Search in Open-domain Multi-Hop QA


48. Imaging-101: Benchmarking LLM Coding Agents on Scientific Computational Imaging


49. Opti-Agent-Bench: Benchmarking End-to-End Optimization R&D Agents on Real-World Business Problems


50. Filtering Harmful Actions Isn’t Enough: Phantom Transfer in Agentic SDF


51. WattCouncil: Context-Aware Household Energy Scenario Generation With Governed LLMs


52. Personalized Emotional Intelligence in Generative AI through Symbolic Affective Reasoning


53. Embark Now: User Demand Oriented Framework for Multi-day Urban Travel Itinerary Planning


54. The Compliance Trap: Diagnosing How AI Agents Consume Conflicting Memory


55. Agentic-DPO: From Imitation to Agentic Policy Optimization on Expert Trajectories


56. MRUF: Multi-granularity Routing with Uncertainty-Aware Fusion for Robust Multimodal Sentiment Analysis


57. Constraint-Aware Hierarchical Search for Regulation-Driven Fine-Grained Classification


58. Laguerre Geometry for Interpreting Large Language Models


59. CRiT-QA: Evaluating Multi-hop Reasoning with Counterfactual Chains and Distractor Traps


60. Large language model agents accelerate inverse design of metal-organic frameworks for gas separation


61. AI YOU Town: Make Friends and Money with Your Digital Twin


62. Cross-Layer Misalignment Detection in Agent Skills: A Progressive Loading-Aware Contrastive Learning Approach


63. Agents Don’t Just Agree, They Remember: Benchmarking Persistent Sycophancy in Stateful Personal Agents


64. GRASP: GRanularity-Aware Search Policy for Agentic RAG


65. ANCHOR: Automated Alignment Auditing for CLI Agents on Real-World Harm


66. Co4ICF: Co-evolving Physics-Informed Surrogate and RL-based Pulse Optimizer for Inertial Confinement Fusion


67. ABot-AgentOS: A General Robotic Agent OS with Lifelong Multi-modal Memory


68. Comparing Socio-technical Design Principles with Guidelines for Human-centered AI


69. Measure the Sim-to-Real Gap: Designing an Affordable Real-World Benchmark Platform for Reinforcement Learning in AIoT Systems


70. SPARK: Susceptibility-Guided Profiling and Steering of Latent Reasoning States in Large Language Models


71. Can Agentic Trading Systems Pay for Their Own Intelligence?


72. Information-seeking failures of large language models in agentic clinical reasoning


73. Behavioural Signatures of Risk-Sensitive Decision-Making in Large Language Models


74. When Are Sparse Feature Interventions Actually Localized? Matched Evaluation for SAE-Based Safety Control


75. KGCQual: An Interpretable Framework for Evaluating the Knowledge Graph Construction Quality from Text


76. GRATE: Temporal Extensions for Inductive KG Foundation Models via Gated Rotary Attention


77. UNIT: Unleash Large Language Models Potential for Graph Continual Learning


78. IdeaTrail: Full-Process Agent Trajectories for Scientific Ideation


79. Dynamic Agent Skills: A Lifecycle Survey and Taxonomy of Evolving Skill Libraries


80. Looped State-Space Language Models with Adaptive Exit-State Selection


81. MAG: A Web-Agent Benchmark and Harness for Multimodal Action and Guide Generation


82. From ambiguous utterances to governed reuse classes: canonicalization, quotient invariance, and conditional decidability


83. AgentAbstain: Do LLM Agents Know When Not to Act?


84. A Symbolic Neural CPU for Quantization-Simulated Writeback and Interpretable Program Execution


85. Who&When Pro: Can LLMs Really Attribute Failures in AI Agents?


86. TopoExplore: Topological Discrimination for Archive-Based Exploration


87. Exploring Agentic Workflows for Generating High Quality Math Visual Aids


88. Agentic Context Learning with Self-Discovered Specification


89. Semantic Drift and the Stability of Operator Control in Reasoning-Class Decision Support Systems


90. PHITSBench: an execution-scored benchmark for AI-assisted PHITS radiation-transport input generation using natural language


91. Length Penalties Make Chain-of-Thought Less Monitorable


92. From Patterns to Maze Structures: SMT-Based Path Synthesis and 2D/3D Construction


93. EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents


94. Verification of Adaptive Agentic Controllers through Finite Rule Revision


95. Norm Enforcement for AI Agents: Robustly Shaping Behavior in Multi-Agent Systems


96. How Much Does Correctness Cost? Budgeted Placement of Strong Correctors in a Weak Multi-Agent Swarm


97. BatteryLake: Agentic, Physics-Grounded Curation of Heterogeneous Battery Aging Data and Benchmarking


98. LegalFarePlan: A Label-Setting Framework for Fare-Transparent Urban Rail Route Planning under Non-Additive Fare Rules


99. Task-Conditioned Synthetic Data Generation for Improving Machine Learning Performance in Agricultural Prediction Tasks


100. Replicating Belief, Not Bits: Epistemic State Replication for Agentic Systems


101. SupplyNetPy: An Open-Source Python Library for High-Fidelity Modeling and Simulation of Arbitrary Supply Chain and Inventory Networks


102. A Theory of Least Autonomy in AI


103. Scaffolding the Strategist: Architecture-Dependent Reasoning Interventions in Hotelling Spatial Markets


104. A Dynamic Scene Interaction Reasoning Framework for Scene-level Lane-Change Intention and Trajectory Prediction of Multiple Interacting Vehicles


105. Coresets Before Score Sets: Evaluation-Unsupervised Prompt Subset Selection for LLM Benchmarks


106. AGM-like Paraconsistent Partial Meet Abductive Expansion Operation


107. Feedback-Coupled Memory Systems in Continuous Time


108. Closed-Loop Control with Rule-Aligned Small Language Models and Multi-Agent Self-Correction


109. The Verifier is the Curriculum: Execution-Gated Self-Distillation for Cross-Family Game Generation


110. GES-TSP: Graph Edge Sparsification for TSP


111. YUKTI: From Natural-Language Situations to Robust, Verifiable Decisions An Uncertainty-Typed Proposition IR, Assumption-Robust Pareto Frontiers, and a Regret Certificate


112. Interpreting Latent CoT Reasoning as Dynamical Systems


113. Boltzmann MapReduce: A Partition-Function Reduce for Forkable Sandboxes


114. Faithful, Not Corrective: Message-Format Effects in Multi-Hop Agent Relays Are Tier-Dependent


115. Format Sensitivity Index: Token-Controlled Prompt Wrapper Robustness and Schema Compliance in LLM Benchmarking


116. From ML Predictions to Informed Diagnostic Assistance Using the Toulmin Model of Argumentation


117. Metacognition in LLMs: Foundations, Progress, and Opportunities


118. Invariant Learning Dynamics of Transformers in Inductive Reasoning Tasks


119. A Minimalist Retargeting-Guided Reinforcement Learning Recipe for Dexterous Manipulation


120. Inside the Unfair Judge: A Mechanistic Interpretability Account of LLM-as-Judge Bias


121. Evidence-Backed Video Question Answering


122. LoRA-Based Cascaded Multimodal Fusion for Action Recognition in Medical Training Environments



124. MM-ToolSandBox: A Unified Framework for Evaluating Visual Tool-Calling Agents


125. Introducing Human-Centeredness in AI-Assisted Lexicography


126. Encoder-Side Neuron Identification and Amplification for Acoustic Perception in Large Audio-Language Models


127. StoryTeller: Training-Free Narrative Grounding for Long-Form Audio Description


128. Evaluating RE Practices for Explainability: Synthesizing Insights from Daimler Truck into an Explainable RE Framework Proposal


129. Time-Lag-Aware Deep Reinforcement Learning for Flexible Job-Shop Scheduling in PPVC Module Factories


130. Active Offline-to-Online Reinforcement Learning


131. An Explainable Agentic System for Detection of Conversational Scams with Summary-Based Memory


132. VoxENES 2026: Benchmarking Generalization of Speech Spoofing Detectors Against LLM-Era TTS and Voice Conversion


133. Agent Hacks Agent: Autoresearch for Production-Agent Red-Teaming


134. From World Action Models to Embodied Brains: A Roadmap for Open-World Physical Intelligence


135. RAGU: A Multi-Step GraphRAG Engine with a Compact Domain-Adapted LLM


136. Closing the Loop: An Access-Control Architecture for Automated, Anomaly-Driven Network Revocation in IoT Deployments


137. Xiaomi-Robotics-U0: Unified Embodied Synthesis with World Foundation Model


138. Extending LLM Context via Associative Recurrent Memory


139. DiffEEG: A Self-Supervised Denoising Diffusion Model for Learning EEG Generic Representations


140. Structure-Feature Aligned Graph Learning via Alternating Constrained Optimization


141. Heuristic Learning for Active Flow Control Using Coding Agents


142. Technical Report on the CVPR 2026@AdvML Workshop Challenge


143. AutoMatBench: An Automatic Optimization Toolkit for the Acceleration of Material Properties Prediction Benchmarking


144. Vinci2: Providing Proactive Assistance in Continuous Egocentric Videos


145. Toward Inclusive Avatar Design with Limb Differences Through Artificial Intelligence


146. CDFM: Towards a General-Purpose Causal Discovery Foundation Model


147. Proxy Exploration and Reusable Guidance: A Modular LLM Post-Training Paradigm via Proxy-Guided Update Signals


148. See like a Robot: Robot-Centric Pointmaps for Vision-Language-Action Models


149. IG-GAN: A Generative Adversarial Network for Aerodynamic Data Generation Based on Intrinsic Geometry


150. Agentic Skill Optimization over Lie Algebroids


151. LightMem-Ego: Your AI Memory for Everyday Life


152. A Multimodal Dataset for Large Language Model Applications in the Energy Domain


153. Uncertainty Quantification for EO Regression Tasks: Building Height, Tree Canopy Height and Above-ground Biomass Estimation


154. Agentic Routing: The Harness-Native Data Flywheel


155. A Glimpse into Long-term Physical Coexistence with Intelligent Robots


156. BackgroundMellow: A Multi-Modal Cohesive Framework for Narrative-Driven Rich Cinematic Soundscape Generation


157. Beyond Sally-Anne: Evaluating Theory of Mind in LLMs using Epistemic Schelling Points


158. Characterising AI Models for Cataloguing


159. Understanding the Impact of AI Code Assistants on Security API Usage: An Empirical Study


160. Longitudinal Multi-View Breast Cancer Risk Prediction


161. Fail-Aware and Explainable Test Oracle Prediction


162. PRISM Edit: One Vector for All Temporal Answers


163. Programming Language Policy as an AI Literacy Equity Problem: A 15-Nation Comparative Analysis


164. The Paternalistic Filter: Epistemic Injustice and Differential Refusal in LLM-Mediated History Education for Marginalized Romanian Students


165. Mako: A Self-Evolving Agentic Operating System (SE-AOS) for Autonomous Web Exploitation


166. A Unified Framework for Comprehensive Cardiac CT Segmentation and Phenotyping: Human-in-the-Loop Data Annotation, Vision Foundation Model Development, Multicenter Evaluation and Clinical Validation


167. Automated Textbook Auditing with Multi-Agent LLM Systems


168. Towards Predictive, Aligned, and Scalable Robot Learning


169. Enhancing LLMs through human feedback: a journey towards self-improvement


170. Multi-Agent LLMs Fail to Explore Each Other


171. An Empirical Study for GUI Test Migration from Android to OpenHarmony System


172. DeepBias: Adaptive In-depth Probing of Social Biases in LVLMs


173. HandFlow: Fully Generative 4D Hand Recovery with Flow Matching


174. ProgramTab: Boosting Table Reasoning of LLMs via Programmatic Paradigm


175. RepTran: Search-Based Repair of Transformer Models


176. Pix2Act: Image-Space Manipulation Policies with Equivariant Augmentation


177. AMT-X: Phase-Structured Multi-Turn Red-Teaming with Checklist-Gated Evaluation


178. BeatEdit: Symbolic Music Generation as Explicit Editing


179. VIA: Visual Interface Agent for Robot Control


180. MusicMark: A Robust Generative Watermarking Framework for Music Generation


181. The Equilibrium Is the Initialization: Lazy Identity Collapse in Physics-Structured Deep Equilibrium Reasoning


182. AgentCheck: A Reproduce-Intervene-Mitigate Workbench for LLM Agents over MCP


183. Controlling Motion Transfer in Diffusion Transformers via Attention Heads


184. Do Video-LLMs Actually Watch? Diagnosing Character-Tracking Failures in Long-Form Video


185. Flout at Your Own Risk: LLMs Struggle with Pragmatic Cooperativity Under Epistemic Asymmetry


186. BackendForge: Benchmarking Agentic End-to-End Code Generation with Backend Services


187. Same Stories, Different Journeys: From Social Comparison to Sensemaking in AI-Mediated Peer Career Exploration


188. SynCLIP: Synonym-Coherent Language-Image Pretraining for Robust Open-Vocabulary Dense Perception


189. Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies


190. Affordance-Based Manipulation Planning with Text Goals and Sim-to-Real Generalisation via Real-to-Sim Image Conversion


191. LoSA-Net: A Localized and Scale-Adaptive Network for Boundary-Sensitive Prediction of Perineural Invasion in 3D MRI


192. Think When It Matters: Conditional VLM Reasoning for Social Navigation with RL Policies


193. MMA-Former: Multi-Window Mixture-of-Head Attention Transformer for Adaptive PNI Prediction in 3D MRI


194. EquiFusion: Kinematics-Agnostic Human Motion Prediction via Equivariant Latent Diffusion


195. CGS: Configurable Graph Summarization with Bounded Neighborhood Loss and Query Support


196. Efficient Online Proportional Sampling with Applications to Smoothed Online Learning


197. Edge Physical AI Deployment of Vision Transformers on Heterogeneous Edge GPU Targeting Autonomous Vehicles


198. The Singularity Space: A Generative Diffusion Framework for Signal Representation


199. The Nuts and Bolts of Natural Language to SQL Translation: A Systematic Analysis of Model Pipeline Optimisation Approaches and their Interactions


200. How Do Practitioners Build SE Agents? Insights from a Mixed-Methods Study


201. 3D-DefectBench: A Controlled Factorial Study of Vision-Language Model Evaluation Pipelines for Fine-Grained 3D Generation Defects


202. Large Language Models for Token-Efficient and Semantic-Preserving Opinion Summarization


203. Auditing Belief-Conditioned LLM Agents in Hidden-Information Social Deduction Games


204. Distributed Agent System: Fault-Tolerant Collaboration Among Embodied Agents


205. Diachronic Sample Integration: Robust Tail-Risk Estimation with Generative Models


206. Abstractiveness Metrics for Evaluating Text Summarization: A Refined Formulation with Empirical Validation


207. Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs


208. LSTrans: Efficient Knowledge Transfer for Lightweight and Automated ECG Classification


209. Lightning Fast Matching Dependency Discovery with Desbordante


210. Multi-Scale Convolution with Optimal Transport Attention Effect on Multivariate Time Series


211. To Answer or to Abstain: Mitigating Search-Agent Hallucinations via Abstention-Aware Reinforcement Learning


212. A Corpus of Persuasion Techniques in Slavic Languages


213. Distributed Denial of Science: How Indirect Data Poisoning of AI Systems Can Industrialize Scientific Fraud


214. PromptGraph: Graph-Guided Prompt Sanitization for Balancing Privacy and Utility in LLM Inference


215. MDQEC-QAS: Meta-Decoding for Quantum Error Correction with Hardware-Aware VQC Search and Confidence-Gated Recovery


216. Action Map Policy: Learning 3D Closed-loop Manipulation via Pixel Classification


217. Learning to Fine-tune Foundation Models under Resource Limitations


218. Commenting with Copilot: A Taxonomy and Multi-Year Analysis of Student Code-Generation Specifications


219. Answer-Conditioned Chain-of-Thought Distillation for Few-Shot Industrial Vision with Small VLMs


220. Unlocking Parallelism in Autoregressive Language Models via Speculative Decoding with Progressive Tree Drafting


221. Coverage Path Planning: Classical Foundations, Recent Advances, and Future Directions


222. Auditing Construct Overlap in Explainable Machine Learning: Evidence from Burnout-Depression Prediction Across Student Cohorts


223. World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning


224. Anamnesis: An Open-Source Platform for Large-Scale Backstory-Conditioned Survey Simulation


225. WasteAssistant: Regulation-Guided Visual Question Answering Framework for Intelligent Waste Segregation and Sustainable Managemen


226. MemDecay: Region-Aware KV Cache Eviction for Efficient LLM Agent Inference


227. DiffUE: Enhancing Utility-Unlearnability Trade-off of Unlearnable Examples via Diffusion Autoencoders


228. Learning from Local Walks on Dynamic Graphs with Bandit Feedback


229. When Does Restricting a Coding Agent to execute_code Help? A Regime $\times$ Agent-Design Ablation


230. Tool-Adaptive LLM Reranker


231. Motif: Discovering and Automating Personal Web Workflows


232. Towards Autonomous and Auditable Medical Imaging Model Development


233. Conditional Optimal Bridge for Riemannian Activation Steering


234. Confining Nondeterminism: AI-Driven Research Systems as DBMSs for Reliable, Non-Wasteful, Transparent, and Collaborative Research [Vision]


235. Temporary Authority, Permanent Effects: Commit-Time Authorization for LLM Agents


236. ARMOR: Stabilizing On-Policy LLM RL with Off-Policy Anchor Samples


237. Reinforcement Learning with Verifiable Physics: Post-training LLMs with Continuous Rewards


238. Annotation-Free Furniture Codes: What They Encode, and How Far They Transfer


239. Context by Distinct Information: An Auditable Dirichlet-Process Working Memory for Long, Redundant Context Streams


240. Learning the Brain’s Dynamics as a Port-Hamiltonian System


241. Mitigating LLM Sycophancy in Code Smell Detection Using Evidence-Guided Reasoning Prompts


242. Spatula: Exploring On-Demand In-Situ Interfaces and Interaction for Attribute Control


243. Large Language Models in Misinformation Ecosystems: Misuse, Defense, and Vulnerability


244. SynthDocBench: Controlled Benchmark for Long-Context Visual Document Understanding


245. A Stepwise Questioning Expert-Editor Multi-Agent Framework for Long-Document Summarization


246. The evolution of AI from image interpretation toward scientific inference in nanoparticle electron microscopy


247. Structured Thoughts For Improved Reasoning And Context Pruning


248. ABot-N1: Toward a General Visual Language Navigation Foundation Model


249. VINE: Taming Generative Control Policies for Reinforcement Learning


250. A Hyperbolic Neural Closure for M1 Radiation Transfer


251. Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift


252. GRC-ProbNet: Uncertainty-aware Feature Extraction for Cardiovascular Disease Classification


253. From Stochastic to Stable: Rank Stability and Structural Sufficiency in AI Visibility Measurement


254. Neutralizing Structural Inequality in the Nigerian FinTech Sector


255. Polarization Detection: A Hybrid Approach with AfroXLMR-Social and DeBERTa for Low- and High-Resource Settings


256. Program-Synthesis-Driven Autodesign of Universal Unitary Operators


257. Partial Contracts Suffice: Sound, LLM-Inferred Regression Verification


258. PhenoEmbed: Self-Supervised Multispectral UAV Time-Series Embeddings for Individual Tree Crown Phenology


259. Exploratory Analysis of Deep Learning Models for Forecasting Meteorological Parameters in the Agricultural Sector


260. Source-Lifted Flow Matching for Intervenable Multimodal Imitation


261. When Does Depth Survive Composition? Compute–Quality Regimes in Latent World Models


262. Comparing Socially-Equitable Renewable Energy Budget Allocation MDP Policies in Mature and Emerging Economies


263. Instruction Set and Language for Hypergraphs


264. Breaking the Quality–Intelligibility Trade-off in Streaming Target Speaker Extraction via Deep-Feature-Anchored Preference Optimization


265. PhysMRV: Physical Memory Retrieval and Verification for Physics Plausibility Reasoning


266. Automated Tensor Scheduling for Hybrid CPU-GPU LLM Inference on Consumer Devices


267. ActiveFly-Bench: Aligning Embodied Question Answering with Vision-Language-Action for Aerial Embodied Perception


268. Beyond Euclidean Clipping: Overcoming Exploration Collapse in LLM RL via Riemannian Isometric Policy Optimization


269. Transcript-Free Lightweight Detection of Alzheimer’s Disease from Spontaneous Speech Using Handcrafted MFCC-Dominant Acoustic Biomarkers


270. EmoStyle: Affective Conditioning of Style-Specialist Experts for Emotional Image Generation


271. FlowPainter: Inpainting Optical Flow via Confidence-Guided Completion


272. LLMs as a Jury: Cross-Model Consensus Can Outperform Process Reward Models for LLM Reasoning


273. SALT-GNN: Handling Dense Neighborhoods in Anti-Money Laundering Graphs via Statistics-Aware Attention


274. GAE: Graph-Augmented Evolution for Scientific Discovery via Reinforcement Optimization


275. ML in a Box: Analyzing Containerization Practices in Open Source ML Projects


276. A Large-Scale Dataset of MCP Implementations on GitHub


277. When Data Imbalance Helps: Robust Generalization Through Shortcut Saturation


278. Cost of Reasoning in non-English Languages: A Case Study on Japanese


279. Minionese: Comprehensive Benchmark and Mechanistic Study of Multilingual LLM Safety


280. Adaptive Model Compression (AMC): Saliency-Driven Resource Allocation for Ultra-Low-Power Transformer Inference


281. Efficiently Adapting Spoken Language Models for the Singaporean Context


282. Quantum Circuit Vision: Cost-Aware Evaluation of Visual AI Agents for Quantum Code Generation


283. Geometric mean-based pairwise comparison method with the reference values – statistical approach


284. Robust, Scalable Detection of Text Containment in Large Web-Crawled Corpora


285. Beyond Bayesian Nash: Learning Minimax-Regret Equilibria for Adversarial Team Games under Asymmetric Information


286. An LLM-powered Agentic Recommendation System for Connected TV Content Discovery


287. A Production-Oriented Framework for Evaluation of SFX Generation


288. Learning in Curved Weight Space:Exponential-Linear Weight Reparameterization for Improved Optimization


289. Workload-Driven Optimization for On-Device Real-Time Subtitle Translation


290. A Foundation Model for Multimodal Event Sequences in Financial Applications


291. A Knowledge-Based Multi-Agent Framework for Security Control Recommendation


292. SMETA-ZSL:Semantic Meta-Alignment for Zero-Shot Threat Classification


293. Faithful by Design: Evaluating and Improving LLM-Generated Clinical Trial Summaries for Multi-Stakeholder Audiences


294. Do These Violent Delights Have Violent Ends? Measuring the Post-Merge Fate of Agentic Code


295. Next-Dense-Stride Prediction for Multimodal Autoregressive Visual Modeling


296. What You Train Is What You Get: Gender Bias, Training Composition, and Post-Hoc Mitigation in Audio Deepfake Detection


297. Remembering Distinct Items, Not Tokens: A Learnable Dirichlet-Process Cache Between State-Space Models and Attention


298. CLIR-Bench: Benchmarking Multimodal Question Answering over Irregular Clinical Time Series


299. Prompting-MammAlps: Fine-Grained Text-to-Video Retrieval for Camera-Trap Data


300. Robo-ValueRL: Reliable Value Estimation for Offline-to-Online Reinforcement Learning


301. Towards Objective Dysgraphia Detection: A Multi-Branch Deep Learning Approach for Online Handwriting Analysis


302. More Structure, Not More Capacity: Object-Centric Representations for Visuomotor Imitation Learning


303. Memory-Conditioned Tool Calling for Camera-First Visual Agents


304. TS-Mask VLA: 2D Temporal-Spatial Masking for Vision-Language-Action Model with Effective Bridging


305. An Autonomous Scientific Knowledge Generation Framework for AI-Driven Scientific Discovery


306. A Unified Model for Highly Accurate ECG-Free Dynamic Coronary Roadmapping Using Spatio-Temporal Transformers


307. Trivial Prompt Reframing Bypasses Safety Guardrails in Googleś MedGemma-4B


308. JEPA for AI-Native 6G: Predictive Representations and Open Challenges


309. Large Multimodal Model-Based Environment-Aware Mobility Management


310. A Comprehensive Survey and Systematic Real-World Evaluation of Embodied Vision-and-Language Navigation


311. Lifelong Representations: A Survey on Continual Self-Supervised Learning for Vision Models


312. Maximizing Human Efficiency in Large-Scale Robot Post-Training via VLAC-Cut Guided Pipeline


313. Listen to the Features: Voice Anonymization Driven by Content Embedding Matching over Signal Reconstruction


314. OmniSCS: Omni Safety-Critical Scenario Synthesis for Autonomous Driving via a Fully Editable Driving World


315. Knowledge-Constrained Shape Optimization with a Mixture-of-Experts Neural Operator for High-Confidence Design


316. Physics-Informed Structure Anchoring With Capture-Aware Prototype Calibration for Cross-Environment RF Fingerprinting


317. ReflectWorld-MM: An Entity-Oriented Multi-Media Memory System for Open-Ended Video Streams


318. RSLoRA: Training-free Rank Allocation for LoRA via Representational Sensitivity Probing


319. Cross-Subject Modeling for Widefield Calcium Imaging via Atlas-Aligned Spatiotemporal Tokenization


320. Unified Backbone Refinement for Diffusion Models via Internal-Latent Analysis


321. Data-Driven Forward and Inverse Modeling of V-Beam Thermal Sensors


322. MorphologyFM: A Foundation Model for Morphology-Aware Representation Learning from ECG and Pulse Oximetry Waveforms


323. SWIFT: A Small-World Interaction Framework for Flow-Aware Trajectory Prediction in Autonomous Driving


324. The Universal Language of CSI:Unifying Wireless Sensing Across Devices and Environments


325. The Ramanujan Challenge For AI


326. Model Collapse: On Recursion, Noise, and Uncharted Machine Visions


327. Mitigating Early Training Collapse in CTR Models


328. Depth-Entropy Guided Sampling for Training-Free LLM Reasoning


329. What Context Does a Coding Agent Actually Need to Act?


330. Transfer Learning Across Policy Regimes in Adaptive Multi-Agent Systems


331. SciML in the Wild: A Diagnostic Study of When Structural Priors Help and When They Hurt


332. Ablation, Statistical Inference, and Validation for KV-Cache Compression


333. ECG-LDC: A Hardware-Efficient Low-Dimensional Computing Framework for ECG Arrhythmia Classification


334. Knowledge Graphs Meet Graph Neural Networks: A Comprehensive Survey


335. Reverse Engineering Compliance: A Dual-Graph Verification Framework for Auditing Legacy IT Security Concepts