전체 AI 논문 - 2026-08-25

1. ReWorld: An Interactive World Model with Long-Horizon Memory


2. Prime Agent: A Self-Improving RLM Harness


3. How AI Assistance Affects Human Skill Development: A Study of Learning with Logic Puzzles


4. Correcting a learned physical invariant improves world-model rollouts


5. EarthVerse: Benchmarking Scientific Agents Across Dynamic Earth Systems and Natural Hazards


6. Mitigating Reasoning-Induced Misalignment via Safety-Direction Penalty


7. SRPO: Self-Reflective Policy Optimization for Long-Horizon Reasoning


8. Multi-Modal Semantic Expansion with Constrained LLM Reranking for Conversational Music Recommendation


9. StrategyBench: Evaluating Explicit Strategy Induction in Large Language Models


10. Characterizing Necessary Losers to Explain Tournaments Losers


11. SkillAlchemy: Open-World Agent Skill Creation


12. MediSkill-Evo: Process-Constrained Self-Evolution for Evidence-Grounded Clinical Interaction


13. Modalities Should Talk to Each Other: Dual-Stream Multimodal Learning for Long-Horizon Influenza Forecasting


14. Walking on the DARKSIDE


15. Agent-G$^2$: Gaussian Guidance for Agentic Reinforcement Learning


16. EviSafe: Evidence-Grounded Safety Evaluation for Vision-Language Models


17. Apodex 1.1: Scaling Agentic Intelligence for Complex Work


18. Hidden in the Request: Explaining Unethical LLM Compliance through Token Relevance


19. Automated Construction of FAIR Digital Object Knowledge Graphs from Flat Cultural Heritage Records


20. Is Next-Chunk Reasoning RL Really Better than SFT? Revisiting Training Strategies under no-CoT Data


21. What is mathematics now, and what should it be?


22. Cognitive Profiling of LRMs’ Reasoning Traces Using Bloom’s Taxonomy


23. AI emotional support is better only when chosen, but shifts preferences even when it is not


24. Jiuge-Tuiqiao: An Interpretable Human-AI System for Classical Chinese Poetry Refinement


25. POOL: Propagated Uncertainty Over Lookalikes


26. AgentWeave: Routing Before Reasoning for Efficient Function Calling in Tool-Rich Language Models


27. From Generation to Simulation: How Far Are World Models from Being True Simulators?


28. Improving O-RADS Risk Stratification from Ultrasound Reports: A Comparative Evaluation of Hybrid versus End-to-End LLM Reasoning Strategies


29. LLM-based Agents for Forecasting and Prediction: Methods, Training, Evaluation, and Applications


30. From Inertia to Objectivity: Improving Deep Research Agents with Noise Isolation


31. AutoSaddler: Automatic Harness Optimization with Durable Updates from Agent Execution Traces


32. MobilePA-Bench: Benchmarking Mobile Planner Agents on Complex Real-World Tasks


33. Artificial Empathy: Towards a Framework for Unsupervised Agency Detection and Policy Reconstruction


34. PsychJail: Exploring Psychological Jailbreaks via Multi-Turn Persuasion of LLM Policies


35. PatchWrite: One Line, Not One Section – Compile-Gated, Validity-Preserving Editing for AI-Drafted Manuscripts


36. SA-RSQ: A Versatile Sparse Representation Framework for Multi-modal Recommender Systems


37. Budget-Constrained Embodied Perception: Four Resource Walls and a Pre-Registered Evaluation of Access-Structured Perception on Open Models at less than 31B


38. Toward Effective and Reliable LLM Agents via Dynamic Ontology


39. ParallelWorld: Test-Time Scaling for Embodied Reasoning


40. Buried in Textual Debt: Context Pruning with Visual Evidence Preservation for MLLM Agents


41. What Process Evaluation of Coding Agents Actually Measures: Action, Task, and Step Are Three Different Levels


42. Concepts for Securing Agentic AI Coding and the Terok Environment


43. Beyond Observed Auxiliary Relations: Environment-Conditioned Modeling for Multi-Behavior Recommendation


44. CDEG: Learning Decision-Critical Evidence for Long-Horizon Diagnostic Agents


45. Proxy reliance in large language model decisions is uncalibrated to predictive evidence


46. Your AI, On a Dial: Controlling Investment Bias in LLMs with a Single Neuron


47. GSAR: Goal-State-Anchor Rewards for Mobile GUI Agents with Self-Evolving Data Synthesis


48. FinixDoc: Rethinking Financial Document Parsing Beyond Saturated Benchmarks


49. Let the Bullets Fly: Multimodal Fake News Detection with Temporal-Aligned Generative Danmaku


50. Beyond the Harness: End-to-End Optimization of Context Artifacts for Enterprise Text-to-SQL


51. Performance of a domain-specific large language model in answering patient questions in psychiatry


52. TailSieve: Partial-Rollout-Guided Tail Routing for LLM Rollouts


53. The Retriever Should Remember: Experience-Amortized Reranking for Long-Term Agent Memory


54. Compositional Chain-of-Relations for Faithful Knowledge Graph Question Answering with Large Language Models


55. The Compaction Cliff in Long-Running AI Agent Memory


56. LLM-Based Selection of Incongruent Verbal and Nonverbal Behavior for Virtual Humans


57. SEAM: Shot Entity-Attribute Memory for Consistent Short-Drama Generation at Scale


58. CacheRouter: A Dual-Path Tool Routing Architecture with Cache-Preserving Main-Model Isolation for Long-Tail Tool Discovery


59. Does Rank Still Matter? Position Bias When AI Agents Shop on Our Behalf


60. Robustness Analysis of Agentic AI to Inconsistent and Incomplete Tool Responses


61. A-CPES: A Reference Framework for Agentic AI in Cyber-Physical Energy Systems


62. CAI-DLLM: Convergence Aware Inference for Diffusion Language Models


63. DeepSAGE: Stage-Aware Reinforcement Learning for Structured CBT Counseling Dialogue


64. Coalition-Aware Skill Reliability for Self-Evolving Agents


65. Weakly supervised concept Bottleneck Learning for Robust Two stage Object centric visual reasoning


66. CausalCache: Conditional High-Fidelity Restoration for Long-Horizon GUI Agents


67. ExecRubrics: Executable Tool-Augmented Rubrics for Verifiable and Efficient Long-Form Evaluation


68. Scaling Curriculum Learning For Autonomous Driving


69. STAGE: Stateful Translation to Agentic Graph Execution with Policy-Scoped Context and Deterministic Control


70. CONTRAMEM: Learning Self-Evolving Procedural Memory from Contrasting Multi-Model Trajectories


71. HANSARD: A Reference Architecture for Forensic Readiness, Runtime Witnessing, and Graded Attribution in Autonomous Multi-Agent AI Systems


72. ClawProBench: Trace-Aware Evaluation of AI Agents with Runtime Coverage and Frozen Workplace-Style Holdouts


73. When Does AI for PDEs Yield Scientific Evidence?


74. Small Reasoning Models are Instruction Followers in Function Calling


75. When Persona Simulations Are Informative: Graph-Structured Signals for Pluralistic Opinion Sensing


76. Think with Structured Grounding: Perceptual Reinforcement Learning for Chart and Visual-Tabular Understanding


77. Where World Models Break: Natural-Input Failure Discovery


78. LLMs for Survey Text Analysis - A Performance Comparison Between Humans and GPT-5 on Inductive Content Analysis


79. WAM-OPD: On-Policy Distillation for World Action Models


80. Analyzing and Mitigating Cross-Lingual Degradation in Multilingual Medical VQA


81. Addressing the Selection Problem in Explainable AI


82. Where Cognition Lives: Dissecting Emergent from Computed Function in a Minimal Complete Cognitive Architecture


83. HERO: Human-profile Enhanced Retrieval Optimization Framework for Long-term Agent Memory


84. Clarify User Expertise: Towards Proactive Conversational Agents Tailoring Responses to User Proficiency


85. Read Less, Solve More: Token-Efficient Sparse Reading for AI Agents


86. Beyond What Meets the Eye: Unveiling Situational Illusions for Multimodal Large Language Models


87. Query-Driven Multimodal Information Extraction from Long Documents


88. Disagree to Explore, Agree to Commit: Routing-Guided Test-Time Scaling for Software Agents


89. Role-Specialized Mixture-of-Agents with Open-Weight LLMs for Clinical Prediction


90. MCP-Universe RL: A Framework for Training MCP Tool-Use Agents via Reinforcement Learning


91. Aggregation-Aware Synthetic Text Generation Against Authorship Re-Identification


92. AUDITA: certified auditing and causal attribution of adverse outcomes in autonomous multi-agent systems


93. Evaluation of Small Vision-Language Models on Qualitative Mechanical Problems


94. MEMONDEMAND: A Memory Management System for Large-Scale Enterprise Data


95. Measuring Stability and Failure Behavior in Language Models Under Structured Perturbations


96. MegaMem: A Retrieval Solution for Ultra-Large Context Windows


97. Task-Driven 3D Printability Assistance via Geometry- and Knowledge-Grounded LLM Reasoning


98. Development and Feasibility Evaluation of an Edge AI as Medical Device System for Breast Cancer Multidisciplinary Team Meetings


99. Hack-Verifiable Terminal Bench: Evaluating Reward Hacking in Terminal Tasks


100. Dissecting Neuro-Symbolic Quality Assurance for Synthetic Oncology Data Generation


101. Decision-Support and Modeling with Large Language Models for Geothermal Well Arrays


102. From SQL Generation to Tool Selection: A Domain-Oriented Pattern for MCP Servers


103. Search Broadly, Seek Evidence on Both Sides, Decide Narrowly: Evidence-Admissible GraphRAG for Longitudinal Clinical Event Verification


104. MEMORY Wins All: Indirect Bias Injection Attacks via Social Media Feeds


105. GenCoord: Skill-Path Commitments under Private Information


106. More Accurate or More Efficient? Evaluating Locally Deployed Compact Open-Weight Language Models for Mathematical Reasoning


107. One-Step Evolution for Long-Time Extrapolation: An Error-Bound-Informed and Prior-Guided Neural Residual Framework for Autonomous PDEs


108. SPAR-Hate: An Auditor-Guided Multi-Agent Framework for Bilingual Hate Speech Parsing


109. DynaContext: Self-Improving Dynamic Contextualization of Optimized Prompts for Heterogeneous Parameter Extraction


110. Redteaming Leading Arabic LLMs with ASAS


111. Beyond Similarity: Heterogeneous Graph Learning for Multi-Objective Food Substitution in Charitable Food Agencies


112. Closed-loop AI achieves certifiable engineering design


113. Repo2Skill-Evo: Repository Skills Go Stale in Silence


114. SSDi8: Accurate and Efficient 8-bit Quantization for State Space Duality


115. TessIndex: Capability Verified Identity System for the Agent Economy


116. Multimodal Prompt Learning with Irregular EHRs for Robust Monitoring of Critical Care Patients


117. GuardianBench: A Same-Scene Instruction-Contrastive Benchmark for Latent Contextual Risk in Embodied AI


118. ESCRAG-R1: Retrieval-Augmented Reinforcement Learning for Emotional Support Conversation


119. Consistency Is Not Coherence: Orientation Search for Certified Alignments Between 4D Defence Upper Ontologies


120. Training Needs Trustworthy Worlds: Verified Synthetic Web Environments for Agent Learning


121. From Solver Feedback to Faithful Plans: Multi-Role Reinforcement Learning for Symbolic Planning


122. HiMA-MDD: A Hierarchical Multi-Agent Harness for Interpretable Multimodal Depression Detection in Clinical Interviews


123. MemGuard: Persisting Verifier Signals for LLM-Agent Memory Governance


124. AI Watchdog: Agent Interfaces for Detecting and Defending Against Manipulative Dark Patterns in AI Conversations


125. LLM4LLM: Bridging Kernel Benchmarks and Real Deployment via Closed-Loop Agentic Optimization


126. GameXpert-Bench: How Far Are Coding Agents from Expert Game Development?


127. Beyond Success and Failure: Length-Aware Contrastive Learning for GUI Agents



129. Hints, Critics, and Teachers: Prior Injection for Sparse-Reward RL in Vision-Language Math Reasoning


130. HIRA: A Human-in-the-Loop Retrieval-Augmented Cascade for Document Classification in Regulated Industries


131. Physics-Knowledge-Guided Hybrid Neural Learning for Arctic Sea Ice Concentration Evolution and Short-Range Prediction


132. What Does CLIP Learn for Regional Geolocalization? Probing Visual Cues and Scene Configuration After Adaptation


133. ECHO: A Cognitively Inspired, Auditable Memory Plane for Long-Horizon Agents


134. Ask or Answer: A Decision Framework for Multi-Turn Health Misinformation Intervention


135. ATHENA: Knowledge-guided agentic neural architecture search for AutoFormer-based electronic health record modeling


136. From Association to Causation: Improving Retrieval Precision of Retrieval-Augmented Generation via Causal Relations and an Attention Mechanism


137. Context as an Environment: Programmatic Context Management for Long-Horizon Agents


138. From Mastery Profile to Simulated Response: Stochastic Student Knowledge Graphs (SSKG) for Faithful LLM Student Simulation


139. Measuring Activation Control in Large Language Models


140. SAEM: Stage-Aware Expert Management for Memory-Efficient MoE Inference in Chain-of-Thought Reasoning


141. Semantic Compression Trees: Multi-Resolution Knowledge Retrieval via Hierarchical Semantic Residuals


142. Generate in the Chart, Not on the Boundary: Function-Symbol Grounding for Hard Constraints in LTN-GANs


143. K-Bench: measuring model performance on real scientific agent requests


144. Data-Driven Dynamic Algorithm Dispatch with Large Language Models


145. Robust Lightweight Deep Learning Models for Oral Cancer Screening


146. A Reproducible, License-Aware Distillation Recipe for CPUDeployable Safety Classification


147. Quantifying geographic domain shift to decouple the geospatial transferability of human mobility flow generation models


148. Let Credit Follow Computation: Architecture-Aware Credit Transport for Large Language Model Reinforcement Learning


149. Enhanced Artificial Neural Networks Using QHAdamW in Air Quality Forecasting


150. Software Frameworks for Explainable AI in Time Series Classification: A Systematic Review


151. Agentic AI for Safety-critical Multi-drone Systems: Challenges and Opportunities



153. Composable Trust Infrastructure for Manufacturing Knowledge Graphs: Cross-System Provenance, Temporal Reasoning, and Decision Traceability


154. Retrieval-grounded robot program generation and simulation-based correction via Model Context Protocol


155. The Abstention Protocol: RCA for Clos Fabrics


156. Hate Speech Classification In Roman Urdu: A Comparative Study On Parameter Efficient Fine-Tuning And Prompt Engineering


157. Spyre-Accelerated Retrieval-Augmented Generation on IBM LinuxONE: A Cloud-Native Architecture for Secure, High-Throughput Enterprise AI Inference


158. There Is No Neutral Harness: Modern LLM Leaderboards Are Manufactured by Config-Fragile Items


159. RIACT: A Responsible AI System for Personalized Study Habit Tracking and Early Burnout Signal Detection in University Students


160. SchemaRouter: Field-Aware Tool Routing for Efficient Heterogeneous Agentic RAG


161. LitReview Arena: Evaluating Literature Review Agents with Battle-Style Peer Review Platform


162. AI Learning and Conceptual Transfer in the Game of Hidden Rules


163. Reviewing Model Collapse and Countermeasures


164. AIREP: A Protocol for Per-Decision Evidence in AI Runtime Governance


165. KVBoost: Chunk-Level Key-Value Cache Reuse with Deviation-Guided Recomputation for Efficient Large Language Model Inference


166. How to Train a Critic Stably and Efficiently


167. SWE Refactor Bench: Can Coding Agents Complete a Long-Horizon, Whole-Repository Stack Migration?


168. EG-ARSA: An Expert-Grounded Open Model for Visual Road Safety Auditing in Low-Resource Settings


169. Physics-Constrained Deep Learning Model for Contactless Blood Pressure Monitoring from Triaxial Bodyseismography


170. ConvergeFlow: Language Flow with Provable Convergence to Token Embeddings


171. The Interaction Tax: When Communication Erases Diversity in Multi-Agent Teams


172. Adapter-Based Few-Shot Continual Learning for Malicious Packet Recognition


173. The Measurement Revolution? Credible Measurement and Inference in the Age of AI


174. When Names Cross Scripts: A Source-Grounded Benchmark for Historical Entity Reconciliation in the Mongol World


175. Act with Intent: Distilling Behavior Intent for Vision-Language-Action Models


176. What’s the Catch? Evaluating Temporal Consistency in Vision-Language Models


177. MetaCaster: Meta-Harness-Optimized Agent for End-to-End Few-Shot Learning of Lightweight Time Series Forecasters


178. InjecMEM: Memory Injection Attack on LLM Agent Memory Systems


179. Machine Learning Assisted Inverse Design of Pixelated mmWave Patch Antennas


180. Reward-Free Continual Adaptation for Resilient Space Robots


181. Towards Comprehensive Basketball Understanding


182. ChebBooster: A Training-Free Approach for Efficient Diffusion Transformer Inference via Chebyshev-Inspired Extrapolation


183. Adaptive Item-based Collaborative Structures via Noise Rescheduling in Diffusion for Generative Recommendation


184. Right-Sizing LLM-Agent Decomposition in VAT Determination: A Pilot Controlled Sweep


185. Towards a Densing Law for User Representation Learning at Billion-Scale Capacity


186. Cross-Domain, Multi-Task Data-to-Text Generation without In-Domain Training Data


187. Cross-lingual Biography Enrichment via Claim Extraction and Alignment


188. Adversarial Entropy Inflation Against Gumbel-Based Inference Verification


189. DF-MoE: Generalizable Deepfake Detection via Multimodal Sparse Mixture-of-Experts


190. The Emergence of Relevance Through Axiomatic Attention Patterns During LoRA Fine-Tuning


191. Thinking Beyond Videos: Unifying Video Reasoning and Deep Research for Open-World Video Agents


192. Mycelial Search: A Graph-Structured Metaheuristic for Continuous Optimisation


193. FIDES: A Concordance Protocol for LLM-Generated Trading Strategies


194. Evaluating SAT Solver Metrics as Predictors of Human-Perceived Nonogram Difficulty


195. Sigmoid Attention as a Better Substrate for Learned KV Cache Eviction


196. How Much Regularization Survives Averaging? Update Masking in Federated Learning


197. E2S-Pruner: Progressive Two-Stage Evidence Fusion for Visual Token Pruning in Vision-Language Models


198. Future Querying: Can LLMs Serve as Implicit Medical World Models?


199. Multi-Winner Voting with Argumentative Ballots


200. Credal Large Language Models for Semantic Commitment under Uncertainty


201. Retrieval-Augmented Classification of Environmental Mitigations in Hydropower Licensing Documents


202. Think Only When Needed: Prompt-Authority Control for Selective Slow-Path Intervention in Vision-Language-Action Manipulation


203. AI Surrogate Modeling for Real-Time Tokamak Equilibrium Prediction: Benchmarking Neural Architectures and Validation on EXL-50U


204. BenthicDINO: Physics-Informed Self-Distillation for View-Invariant Side-Scan Sonar Representations


205. NetConfArena: An Executable Benchmark for LLM Agents in Closed-Loop Network Configuration


206. Counterfactual Transition Graphs: Evaluating Cross-Class Transition Quality


207. Language Chain in Alignment: Cross-Lingual Ranking Preference Optimization


208. Pointing-VLA: Typed Spatial Grounding Interfaces for Vision-Language-Action Manipulation


209. LITERARYBIGFIVE: Author-Personalized Text Generation in a Unified Interpretable Space


210. Statistical Machine Translation Systems of English-Pnar Language Pair : Some Insights of the Emperical Study


211. DeMixPert: Decomposed Response Modeling with Gaussian Mixtures for OOD Single-Cell Perturbation Prediction


212. Molecular LLM Agents: From Architectural Design to Scientific Autonomy


213. PolyChirp: Multi-Species Birdsong Classification Using TinyML on Low-Power Acoustic Sensors


214. Shaping the Evolutionary Dynamics of Robot Morphology via Adaptive Control Learning


215. Cultural Moment Benchmark: Evaluating Video Cultural Reasoning and Grounding in Southeast Asia


216. Beyond Verdicts: A Graph-Based Analysis of Human and LLM Reasoning in Scientific Fact-Checking


217. The Multilingual FrameNet Corpus


218. FedCC: Towards Addressing Label Distribution Skews in Distillation-Based Federated Learning


219. Beyond Surface Cues: Disentangling Sociocultural Signals in Multilingual LLMs


220. Unlearning Is Not Just Erasing: Temporal Decoupling via Generation Inequality


221. SplitLite: Low-Rank Residual Compression for Split Learning


222. Coarse Indexing, Fine Evidence: Decoupling Temporal Granularity in Long-Video RAG


223. A Physical Response-and-Memory Model for Muon Optimization


224. Hypergraph Embedding Indexing for Efficient Dense Vector Retrieval


225. WildHandBench: A Benchmark for Handwritten Text Understanding that Challenges MLLMs and Humans


226. What Proves You Wrong: Benchmarking Language Models on Falsifiable Research Ideation


227. Deep Learning-Based Multi-User Communication Design for Dense IoT Networks: Interference-Aware Finite-Blocklength Communication and Preliminary MIMO Extensions


228. Safety Hacking in Constrained Best-of-$N$ Inference-time Scaling


229. Do Spoken Language Models Hear Speech as They Read Text? Bridging Structural Gaps Between Speech and Text


230. AraDetox: A Multi-Dialect Arabic Detoxification Dataset


231. The Mask Is Not the Model: Auditing Prefix Invariance in Attention, State-Space, and Hybrid Sequence Models


232. Hierarchy-Aware Supervised Uncertainty Estimation for Black-box LLM Taxonomic Reasoning


233. Minimal Local Simulation Foundations for LLM- and VLM-Driven Agents in 2D and 3D Environments


234. Fairness-Aware Mixture-of-Experts via Subgroup Reweighting and Gate Regularization


235. SDoH-Aware Narrative Anchoring Bias in Medical LLMs for Trustworthy Clinical Decision Support


236. Triplet2Track: A Hierarchical System with Object-Centric Representations for Reliable Long-Horizon Manipulation


237. TRACE: A Self-Evolving Skill Bank for Consistent, Limit-Aware LLM Agents


238. Don’t Repeat Yourself: Stopping Verbatim Loops at Sampling Time


239. XTC: Head-Aware Sampling by Excluding Top Choices


240. Object-Uni: A Unified Model for Object-Centric Spatial Understanding and Controllable Generation


241. DiaRelay: Relaying Dialogue Context with a Constant-Size Memory for Emotion Recognition in Conversation


242. TEE-X: TEE-aware Acceleration Framework for Large Vision Models at the Edge


243. Enrich-Retrieve-Rank: Scaling Capability Discovery Beyond In-Context Routing


244. RACO: Reliability-Aware Coarse-Goal Optimization for Inspection-Oriented UAV Vision-Language Navigation


245. Hyperbolic Hierarchical Clustering for Visual Representation Learning


246. Physical Agentic AI: An Architecture for Orchestrating a Robot Crew with LLMs


247. Evaluating Inference-Time Defenses Against Package Hallucination in LLM-Generated Code


248. Mol-JEPA: A multimodal Joint Embedding Predictive Architecture for Molecules


249. Do Not Copy/Paste: Soft Barriers for Copying in AI-Assisted Programming


250. GeoRisk-RAG: A Hierarchy-Aware Risk Framework for Improving RAG Reliability through Selective Answering


251. Teaching LLMs How ICU Physicians Approach Clinical Reasoning Through OMOP-Aligned Retrieval Improves Reasoning Across Clinical Domains


252. AI-based worker guidance in assembly and disassembly operations using multimodal ego/exo-centric data capture and structured task knowledge


253. Vision-Language Models for Occupational Physical Exposure Assessment: Estimating External Hand Forces in Manual Material Handling Tasks from RGB Video


254. Clinical Graph-JEPA: Predictive Patient-State Knowledge Graphs for Cognitive Decision Support


255. Hybrid Panels: Toward Human-AI Collaboration in Survey Research


256. BLADE: Bilevel Low-rank Augmented-Lagrangian Erasure for LLM Unlearning


257. Functional compatibility as a determinant of persistent neural learning


258. EMPIRE: Explicit Manipulation Planning as a Learnable Intermediate Representation for Egocentric Hand-Motion Forecasting


259. Rank Reversal in Multilingual LLM Judges: A Label-Free Double-Centering Calibrator


260. Cross-Subject Generalization in Decoding Perceived Speech from Non-Invasive Brain Recordings


261. KONTOGRAPH: Verified Point-in-Time Feature Consistency and Amortised Explanation for Real-Time Anti-Money Laundering under a 200 ms Decision Budget


262. ProBel: Propaganda Detection with Techniques, Spans, and Explanations


263. Self-Supervised Graph Representation Learning for In-The-Wild Wearable and Smartphone based Emotion Recognition


264. Pre-Decoding Acoustic Triage for Budgeted Vision-Language Captioning of Untrimmed Egocentric Video


265. SANE: State Anomaly Neutralization for Stable Extreme-Context Delta-Rule Models


266. Multimodal examination answer data with expert-designed Outcome-Based Education rubrics for criterion-level assessment


267. TransHands: Repurposing Human Pose Encoders as Hand Pose Encoders


268. Register Shifts Break LLM Safety: A Bengali Benchmark with Culturally Grounded Harms


269. The Imitator Game: Benchmarking Robot Imitative Ability Beyond Action Prediction


270. LLM Evaluation on Unseen Questions: Contextual Multidimensional IRT Model


271. Learning from the Test: Self-Referential Differential Testing for Deep RL Agents


272. OVIBench: Benchmarking Online Video Question Answering under Interruption


273. Length-Adaptive Decoding for Masked Diffusion Machine Translation


274. Multi-Task Learning for Non-Canonical Phoneme Recognition via Articulatory Feature Decomposition


275. GAN-Diff : Coupling Pretrained WGAN-GP Features with Conditional Diffusion U-Nets


276. Training-Free VLM Personalization via Calibrated Residual Decoding


277. Improving Few-Step Language Flows with Untied Self-Conditioning


278. FreKoo++: Learning Continuous Spectral Dynamics for Temporal Domain Generalization


279. Spending Scarce Confirmatory PET Measurements: Target-Aligned Validation in A4/LEARN


280. Joint Causal Structure and Cluster Discovery Using Variational Inference


281. Why Does Robustness Reduce Superposition?


282. Meta-Ctrl: Guaranteed Plan Generation by Decoupling Syntactic and Semantic Constraints


283. Lexical Perturbations Disrupt LLM Reasoning: An Empirical Study of Attention Diversion


284. SSE-Bio: A Structured Self-Evolving Agent with Agentic Retrieval Policy for Multi-Hop Biomedical Reasoning


285. TRACE: Artifact-Robust Statistical Shape Modeling from Imperfect Surface Scans - A Case Study in Craniosynostosis 3D Photography


286. Learning Implicit Constitutive Laws for Dynamic 3D Gaussian Splatting from Monocular Videos


287. Semantic Reasoning Denoising: Correcting Language Model Reasoning with Semantic Operators


288. On Predicting Vulnerability Severity Using In-Context Learning: An Industrial Case Study


289. Improving Energy Efficiency of Oil Platforms Through Optimal Loading of Diesel Generators Using Machine Learning and Search Algorithms


290. Real-TurnTurk: A Multimodal Turkish Corpus for Turn-Taking Prediction


291. Inferring Action from Future Latent State for Robotic Manipulation


292. ADMIL: Attention-Distilled Multiple Instance Learning for Selective Foundation Model Inference in Pathology


293. Discovering Dual-Origin Slow Wind from Solar Orbiter with Self-Supervised Contrastive Learning


294. CRS-Bench: A Reference-Relative Reliability Benchmark for Medical Image Encoders


295. Multi-Agent Discovery and Resource-Aware Autonomous Exploration of Scientific Datasets


296. Barycentric Fused Gromov-Wasserstein Balancing for Causal Inference under Multiple Treatments


297. Variance Driven Exploration: A Provable and Efficient Methodology for Pure Exploration in Highly Stochastic Environments


298. NoTB: Oracle-Free Triage of LLM-Generated RTL via Cross-Model Formal Consensus


299. Bulbul: A Dataset for Dialectal Arabic Speech Recognition


300. EDGE: Experience-Distillation for Guided Exploration in Agentic Reinforcement Learning


301. Bi-EZP: LLM-Guided Bilevel Program Evolution for Ensemble Zero-Cost Proxy Discovery


302. Breaking the Assumptions: Auditing Input-Side Jailbreak Defenses Against Semantic Attacks


303. A Scalable Vector Graphics Latent Space


304. Pruned Traffic Trees: Native Semantic Compression with a Protocol-Structured Model Family for Encrypted Traffic Classification


305. GuardPaint:SpeculativeSafetyDecodingforText-to-ImageGeneration


306. BioMed-Agent-RL: A Meta Learning, All You Need for Biomedical Applications


307. HiDiffTIR: Hierarchical Difficulty-Aware Policy Optimization for Multi-Turn Tool-Integrated Reasoning


308. ChainPrune: Evaluating and Reducing Redundancy in Long Chain-of-Thought Reasoning


309. LLMs are Few-Shot Decision-Makers: Generalized Context-Aware Microgrid Frequency Control through Prompt Decision Transformer


310. Training a Knowledge Base: Supervised Structure Learning for Agent-Curated Document Stores


311. PatchGate: Narrowing the Verbalization Gap with Intrinsic Object Inventories in Frozen Vision-Language Models


312. More Computational Resources Do Not Ensure Higher Scholarly Impact: Evidence from Leading NLP Conference Papers


313. ExplainGuard: A Zero Trust Framework for Post-Hoc Explanation Integrity Guarantees in Blackbox XAI Models


314. SAFE-G: Structure-aware Faithful Evidence-guided Generation for Knowledge-based Visual Question Answering


315. Lexical Coupling in GUI Element Grounding: Sentence Embeddings Track Labels across Mobile and Web


316. Evaluation Awareness in Language Models: Representation, Verbalization, and Control


317. LiteEvent-AE: Lightweight Autoencoder for Event-Based Vision on Low-Latency Energy-Constrained Edge Devices


318. Architecture as Capability Equalizer for Coding Agents


319. Reinforcement Learning on Benign Facts Amplifies Leakage of Memorized Private Data


320. Scalable quantum simulation of continuous-time generative models via tensor networks


321. Read, Write, Relax: Why Neural PDE Surrogates Need Both Global and Local Processing


322. SynEHR: Joint Modeling Inter-visit Temporal Evolution and Intra-visit Clinical Structure for Longitudinal EHR Synthesis


323. Why This, Not That? Mining User Profiles for Pair-wise Counterfactuals


324. Power-Performance Characterization of TinyML Systems


325. Anchoring Bias: A Persistent Fairness Backdoor Attack against MLLMs under Continual Learning


326. Automating Multi-Hop RAG Evaluation via TRIAD: From Context Extraction to Validated Dataset Generation


327. Forgotten in Weights, Recovered by Tools: Agentic Tool Unlearning for LLM Agents



329. SecOPD: Mitigating Adaptive Prompt Injections by On-Policy Distillation


330. Selection of Heart Sound Segments for Synchronous Classification of Multi-channel Heart Sounds


331. KAN-Robust-Bench: A Benchmark for Evaluating the Robustness of Kolmogorov-Arnold Networks


332. TASSO: TAsk-Specific Subspace Optimization for Continual Learning of Vision-Language Models


333. Reliability- and Anatomy-Consistency-Aware Multimodal Learning for Robust Fracture Classification from Bangladeshi Radiographs


334. Complexity Induction: Compositional Generalization via Structured Label Distortion


335. CyrillicQA: The Influence of Phonetically Encoded Secret Language on LLM Performance


336. FigmaTrace: Capturing Creative Nuances in Human Figma Design Workflows


337. Constructing Predictive Surgical Path for AI-based Capsulorhexis Skill Transfer


338. Geo-VLA: Geometry-Aware Vision-Language-Action Planning via Internalization of Map Semantics


339. Aligning Human Sense: Calibrated Distributional Reward Learning for Video Generation


340. Agentic Security: A Systematization of Tools, Failure Modes, and Design Laws for LLM-Driven Penetration Testing


341. Operational digital twin clinics enable task-based evaluation of embodied AI


342. Mitigating Bias in Large Vision-Language Models via Counterfactual Ensemble Decoding



344. Mamba-based Selective State Space Modeling Improves the Accuracy-Complexity Tradeoff of SmolVLA Vision-Language-Action Experts


345. Runtime Action Interference for AI Control of AlphaStar in StarCraft II


346. ODG-NoMaD: Overhead-Camera Direction-Guided NoMaD


347. A Survey Instrument to Assess Students’ AI and Generative AI Knowledge


348. Interrupting the Chain: Human Perception of AI-Generated Disinformation Through a Kill Chain Lens


349. Model of Models: When Does Emitting a Specialist Beat Attending, Adapting, or Tuning?


350. A Social Media Analysis of Discourse on the Israel–Palestine Conflict on Telegram


351. Beyond Two Bytes per Letter: Tokenization Overhead in Cyrillic AI Systems


352. Determinants of Starting Salaries for Filipino Graduates: An Explainable Machine Learning Approach


353. RoboShape: Information-Theoretic Point Cloud Representations for Privacy-Aware Robot Perception


354. Agentic Scaffolding Amplifies Sycophantic Behavior in Large Language Models


355. On the Role of Citations in Preference Data


356. Wazobia Eval: A Benchmark for Nigerian Pidgin Emotion Understanding, Sarcasm Detection, and Cultural Reasoning


357. PepLLM: ESM-Guided Llama for Structured Protein-Peptide Binding Interface Analysis



359. Distinguishing Revision and Delayed Elaboration in Incremental Narrative Interpretation


360. Triangular Fuzzy Rescaling Distance


361. Small Language Model enabled Autonomous agent for Language-Conditioned Cognitive Radar


362. Correcting Variable Importance Scored by Random Forests