전체 AI 논문 - 2026-06-05

1. MLEvolve: A Self-Evolving Framework for Automated Machine Learning Algorithm Discovery


2. Goedel-Architect: Streamlining Formal Theorem Proving with Blueprint Generation and Refinement


3. Benchmark Everything Everywhere All at Once


4. Vortex: Efficient and Programmable Sparse Attention Serving for AI Agents


5. Agent Memory: Characterization and System Implications of Stateful Long-Horizon Workloads


6. Unsupervised Skill Discovery for Agentic Data Analysis


7. Risk Assessment of Autonomous Driving: Integrating Technical Failures, Ethical Dilemmas, and Policy Frameworks


8. Humans’ ALMANAC: A Human Collaboration Dataset of Action-Level Mental Model Annotations for Agent Collaboration


9. Rethinking Infrastructure Inspection as Image Difference Classification: A Traffic Sign Case Study


10. An Infectious Disease Spread Simulation Based on Large Language Model Decision Making


11. Where Should Knowledge Enter? A Layered Framework for Knowledge Infusion in Multimodal Iterative Generative Mo


12. Boosting Brain-to-Image Decoding with TRIBE v2 Data Augmentation


13. TokenMizer: Graph-Structured Session Memory for Long-Horizon LLM Context Management


14. DragOn: A Benchmark and Dataset for Drag-Based GUI Interactions


15. LLM Self-Recognition: Steering and Retrieving Activation Signatures


16. AIS-Based Vessel Trajectory Prediction Using Memory-Augmented Neural Networks


17. Multi-ResNets for Subspace Preconditioning in Constrained Optimization


18. TRACE: A Temporal Conditional Estimation for Multimodal Time Series Foundation Models


19. ToolChoiceConfusion: Causal Minimal Tool Filtering for Reliable LLM Agents


20. RedKnot: Efficient Long-Context LLM Serving with Head-Aware KV Reuse and SegPagedAttention


21. Closing the Loop on Latent Reasoning via Test-Time Reconstruction


22. From Reward-Hack Activations to Agentic Risk States: Context-Calibrated Mechanistic Monitoring in LLM Agents


23. Evaluating Agentic Configuration Repair for Computer Networks


24. Unsupervised Pattern Analysis in Japanese Veterinary Toxicology: A Regulatory-Compliant Framework for Cross-Species Risk Assessment


25. Learning to replenish: A hybrid deep reinforcement learning for dynamic inventory management in the pharmaceutical supply chains


26. ProSarc: Prosody-Aware Sarcasm Recognition Framework via Temporal Prosodic Incongruity


27. Where does Absolute Position come from in decoder-only Transformers?


28. Amortizing Federated Adaptation: Hypernetwork Driven LoRA for Personalized Foundation Models


29. WorldFly: A World-Model-Based Vision-Language-Action Model for UAV Navigation


30. Towards Healthy Evolution: Exploring the Role and Mechanisms of Human-Agent Interaction in Self-Evolving Systems


31. Step-adaptive multimodal fusion network with multi-scale cloud feature learning for ultra-short-term solar irradiance forecasting


32. CogManip: Benchmarking Manipulative Behavior in Multi-Turn Interactions with Large Language Model


33. Integrating Mechanistic and Data-Driven Models for Neurological Disorders through Differentiable Programming


34. Beyond Semantic Organization: Memory as Execution State Management for Long-Horizon Agents


35. A Framework for Measuring Appropriate Reliance on Set-Valued AI Advice


36. Learning Visual Spatial Planning from Symbolic State via Modality-Gap-Aware Self-Distillation


37. When Should Memory Stay Silent: Measuring Memory-Use Boundaries in Memory-Augmented Conversational Agents


38. Beyond Similarity: Trustworthy Memory Search for Personal AI Agents


39. Memory is Reconstructed, Not Retrieved: Graph Memory for LLM Agents


40. RedditPersona: A Modular Framework for Community-Conditioned LLM Adaptation from Reddit


41. PLAN-S: Bridging Planning with Latent Style Dynamics for Autonomous Driving World Models


42. Beyond Vector Similarity: A Structural Analysis of Graph-Augmented Retrieval for Industrial Knowledge Graphs


43. Framing, Judging, Steering: An Assessable Competency Model for Teach-ing Students to Reason With Generative AI


44. The Self-Correction Illusion: LLMs Correct Others but Not Themselves


45. Bidirectional Search for Longest Paths: Case for Front-to-Front Heuristics


46. Edit-R2: Context-Aware Reinforcement Learning for Multi-Turn Image Editing


47. A Pre-Registered Causal Partition of Self-Consistency Elicitation and Reward Design in RLVR


48. Towards World Models in Biomedical Research


49. Retrospective Harness Optimization: Improving LLM Agents via Self-Preference over Trajectory Rollouts


50. Retry Policy Gradients in Continuous Action Spaces


51. QCFuse: Query-Aware Cache Fusion via Compressed View for Efficient RAG Serving


52. Entropy-Based Evaluation of AI Agents: A Lightweight Framework for Measuring Behavioral Patterns


53. Agentic Molecular Recovery via Molecule-Aware Exploration


54. Statistical Priors for Implicit Preferences: Decoupling Skill Selection as a Local Harness in Personal Agents


55. When Tools Fail: Benchmarking Dynamic Replanning and Anomaly Recovery in LLM Agents


56. From Risk Classification to Action Plan Remediation: A Guardrail Feedback Driven Framework for LLM Agents


57. Can LLMs Write Correct TLA+ Specifications? Evaluating Natural-Language-to-TLA+ Generation


58. TAPO: Tool-Aware Policy Optimization via Credit Transfer for Multimodal Search Agents


59. SubtleMemory: A Benchmark for Fine-Grained Relational Memory Discrimination in Long-Horizon AI Agents


60. Class-Specific Branch Attention for Mitigating Gradient Interference under Class Imbalance


61. When AI Says It Feels


62. DiG-Plan: Mitigating Early Commitment for Tool-Graph Planning via Diffusion Guidance


63. Critic-Guided Heterogeneous Multi-Agent Reasoning for Reliable Mathematical Problem Solving


64. Seeing Time: Benchmarking Chronological Reasoning and Shortcut Biases in Vision-Language Models


65. PerceptUI: LLM Agents as Human-Aligned Synthetic Users for UI/UX Evaluation


66. AdaMEM: Test-Time Adaptive Memory for Language Agents


67. Beyond Output Matching: Preserving Internal Geometry in NVFP4 LLM Distillatio


68. Do More Agents Help? Controlled and Protocol-Aligned Evaluation of LLM Agent Workflows


69. Continual Learning Bench: Evaluating Frontier AI Systems in Real-World Stateful Environments


70. Coding with “Enemy”: Can Human Developers Detect AI Agent Sabotage?


71. FIDES: Faithful Inference via Deep Evidence Signals for Retrieval-Memory Conflict in RAG


72. Answer Presence Drives RAG Rewriting Gains


73. Evaluation of LLMs for Mathematical Formalization in Lean


74. Self-Commitment Latency: A Reward-Free Probe for Prompted Implicit Hacking


75. Safety Paradox: How Enhanced Safety Awareness Leaves LLMs Vulnerable to Posterior Attack


76. Multilingual Fine-Tuning via Localized Gradient Conflict Resolution


77. Fix the Mind, Not the Move: Interpretable AI Assistance via Knowledge-Gap Localization


78. GuardNet: Ensemble Strategies of Shallow Neural Networks for Robust Prompt Injection and Jailbreak Detection


79. SoCRATES: Towards Reliable Automated Evaluation of Proactive LLM Mediation across Domains and Socio-cognitive Variations


80. Individual Gain, Collective Loss: Metacognitive Adaptation in AI-Assisted Creativity


81. When Should We Protect AI? A Precautionary Framework for Consciousness Uncertainty


82. SciVisAgentSkills: Design and Evaluation of Agent Skills for Scientific Data Analysis and Visualization


83. EpiEvolve: Self-Evolving Agents for Streaming Pandemic Forecasting under Regime Shifts


84. Severity-Aware Curriculum Learning with Multi-Model Response Selection for Medical Text Generation


85. Step-by-Step Optimization-like Reasoning in LLMs over Expanding Search Spaces


86. PSEBench: A Controllable and Verifiable Benchmark for Evaluating LLMs in Patient Safety Event Triage


87. Output Type Before Quality: A Standards-Derived XAI Admissibility Rubric for Autonomous-Driving Safety


88. Insurance of Agentic AI


89. Brick-Composer: Using MLLMs for Assembly with Diverse Bricks


90. Ten Headache Specialists versus Artificial Intelligence for Clinical Literature Summarization: A Critical Evaluation and Comparison


91. Zero knowledge verification for frontier AI training is possible


92. Minimizing the Hidden Cost of Scales: Graph-Guided Ultra-Low-Bit Quantization for Large Language Models


93. Assessing the Carbon Emissions and Energy Consumption of U.S. Hyperscale Data Centers


94. A Motivational Architecture for Conversational AGI


95. Mutation Without Variation: Convergence Dynamics in LLM-Driven Program Evolution


96. Agents’ Last Exam


97. Harnessing Generalist Agents for Contextualized Time Series


98. LeanMarathon: Toward Reliable AI Co-Mathematicians through Long-Horizon Lean Autoformalization


99. Residual Modeling for High-Fidelity Learned Compression of Scientific Data


100. Stability vs. Manipulability: Evaluating Robustness Under Post-Decision Interaction in LLM Judges


101. Synthetic Contrastive Reasoning for Multi-Table Q&A


102. An interpretable and trustworthy AI framework for large-scale longitudinal structure-pain association studies using data from the Osteoarthritis Initiative (OAI)


103. SentinelBench: A Benchmark for Long-Running Monitoring Agents


104. Uncertainty Aware Functional Behavior Prediction and Material Fatigue Assessment for Circular Factory


105. GITCO: Gated Inference-Time Context Optimization in TSFMs


106. I Know What You Meme, Even If it Emerged Today: Understanding Evolving Memes through Open-World Knowledge Acquisition


107. What Should Agents Say? Action-state Communication for Efficient Multi-Agent Systems


108. How Far Did They Go? The Persuasive Tactics of Covert LLM Agents in a Discontinued Field Experiment


109. HANDOFF: Humanoid Agentic Task-Space Whole-Body Control via Distilled Complementary Teachers


110. Code2LoRA: Hypernetwork-Generated Adapters for Code Language Models under Software Evolution


111. TempoVLA: Learning Speed-Controllable Vision-Language-Action Policies


112. Regret Minimization with Adaptive Opponents in Repeated Games


113. Operation-Guided Progressive Human-to-AI Text Transformation Benchmark for Multi-Granularity AI-Text Detection


114. Pretraining Recurrent Networks without Recurrence


115. RREDCoT: Segment-Level Reward Redistribution for Reasoning Models


116. Self-Augmenting Retrieval for Diffusion Language Models


117. PC Layer: Polynomial Weight Preconditioning for Improving LLM Pre-Training


118. You Only Index Once: Cross-Layer Sparse Attention with Shared Routing


119. Will the Agent Recuse Itself? Measuring LLM-Agent Compliance with In-Band Access-Deny Signals


120. In-Context Multiple Instance Learning


121. RiskFlow: Fast and Faithful Safety-Critical Traffic Scenario Generation


122. Double Preconditioning (DoPr): Optimization for Test-Time Performance, not Validation Loss


123. HomeWorld: A Unified Floorplan-to-Furnished Framework for Generating Controllable, Densely Interactive Whole-Home Scenes


124. Emergent Language as an Approach to Conscious AI


125. EasyLens: A Training-Free Plug-and-Play Subtle-Lesion Representation Amplifier for Medical Vision-Language Models


126. LatentWave: JEPA Pretraining for Wireless Foundation Models


127. F3-Tokenizer: Taming Audio Autoencoder Latents for Understanding and Generation


128. Bridging Domain Expertise and Generalization for Performance Estimation


129. Subspace-Aware Sparse Autoencoders for Effective Mechanistic Interpretability


130. PAMF: Prior-Aware Multimodal Fusion for Incomplete Time Series Data


131. Learning What to Forget: Improving LLM Unlearning via Learned Token-Level Importance


132. Quantum enhanced rare event discovery and sampling


133. Plug-and-Play Guidance for Discrete Diffusion Models via Gradient-Informed Logit Correction


134. Towards One-to-Many Temporal Grounding


135. LLMs Can Leak Training Data But Do They Want To? A Propensity-Aware Evaluation of Memorization in LLMs


136. Adapting Diffusion Language Models for Lossless Pixel-Level Image Transmission


137. Your GFlowNet Secretly Learns an Optimal Transport Plan


138. DAST: A VLM-LLM Framework for Cross-Interface Anomaly Detection in O-RAN


139. OneReason Technical Report


140. MPCoT: Reward-Guided Multi-Path Latent Reasoning for Test-Time Scalable Vision-Language-Action


141. Benchmarking Open-Source Layout Detection Models for Data Snapshot Extraction from Institutional Documents


142. TOKI: A Bitemporal Operator Algebra for Contradiction Resolution in LLM-Agent Persistent Memory


143. Design a Reliable LLM-Integrated Interface for Mortality Forecasting


144. Bridging the Semantic-Collaborative Gap: An Asymmetric Graph Architecture for Cold-Start Item Recommendation


145. CLEAR: Cognition and Latent Evaluation for Adaptive Routing in End-to-End Autonomous Driving


146. TAM: Torque Adaptation Module for Robust Motion Transfer in Manipulation


147. DisasterBench: A Multimodal Benchmark for UAV-Based Disaster Response in Complex Environments


148. Towards the Readability of LLM-Generated Codes through Multitask Representation Engineering


149. Dense Contexts Are Hard Contexts: Lexical Density Limits Effective Context in LLMs


150. Improving Answer Extraction in Context-based Question Answering Systems Using LLMs


151. Learning to Route LLMs from Implicit Cost-Performance Preferences via Meta-Learning


152. ITP-STDP: An Intrinsic-Timing Power-of-Two Learning Engine for On-Chip SNN Training


153. A Finite Certificate for the Positive $n=9$ Vasc Inequality


154. TLA-Prover: Verifiable TLA+ Specification Synthesis via Preference-Optimized Low-Rank Adaptation


155. Harnessing Structural Context for Entity Alignment Foundation Models


156. OrderGrad: Optimizing Beyond the Mean with Order-Statistic Policy Gradient Estimation


157. LatentSkill: From In-Context Textual Skills to In-Weight Latent Skills for LLM Agents


158. On Advantage Estimates for Max@K Policy Gradients


159. MDP-GRPO: Stabilized Group Relative Policy Optimization for Multi-Constraint Instruction Following


160. Metamorphic Testing with the Rashomon Set: Explanation Faithfulness in Machine Learning


161. Sample-efficient Low-level Motion Planning for Robotic Manipulation Tasks via Zero-shot Transfer Learning


162. When Good Enough Is Optimal: Multiplication-Only Matrix Inversion Approximation for Quantized Gated DeltaNet


163. EGTR-Review: Efficient Evidence-Grounded Scientific Peer Review Generation via Multi-Agent Teacher Distillation


164. OPRD: On-Policy Representation Distillation


165. ATT-CR: Adaptive Triangular Transformer for Cloud Removal


166. Deep Learning-based 3D Oral Cavity Reconstruction Using 2D Intraoral Images


167. AttackPathGNN: Cross-function vulnerability detection in smart contracts using state interference graphs and conjunction pooling


168. World-Language-Action Model for Unified World Modeling, Language Reasoning, and Action Synthesis


169. Measuring the sensitivity of LLM-based structured extraction to prompt, model, and schema choices in clinical discharge summaries


170. Causal Scaffolding for Physical Reasoning: A Benchmark for Causally-Informed Physical World Understanding in VLMs


171. Learning of Robot Safety Policies via Adversarial Synthetic Scenarios


172. To Be Multimodal or Not to Be: Query-Adaptive Audio-Visual Person Retrieval via Active Modality Detection


173. Better Literary Translation: A Multi-Aspect Data Generation and LLM Training Approach


174. Reducing Hallucinations in Complex Question Answering using Simple Graph-based Retrieval-Augmented Generation (long version)


175. Staying with the Uncertainty: Uncertainty-Scaffolding Strategies for Artificial Moral Advisors in LLM-to-LLM Simulated Conversations


176. LadderMan: Learning Humanoid Perceptive Ladder Climbing


177. Compositional Boundaries for Density Fusion


178. Deciphering Two Training Clocks in Grokking via Deep Linear Network Theory with Conditional ReLU Reduction


179. LLMCodec: Adapting Video Codecs for Efficient Weight Compression of Large Language Models


180. EEGDancer: Dynamic Emotion Latent Space Masked Modeling with Reinforcement Learning for EEG Continuous Emotion Prediction


181. UniVoice: A Unified Model for Speech and Singing Voice Generation


182. GenTI: Benchmarking LLMs for Autonomous IDPS Rule Generation for Unseen Attacks


183. Mechanistic Insights into Functional Sparsity in Multimodal LLMs via CoRe Heads


184. Learning Geometric Representations from Videos for Spatial Intelligent Multimodal Large Language Models


185. Benchmarks in Leipzig


186. Consistency Training Along the Transformer Stack


187. Emotion-Aware Image Generation from Korean Diary Text via LLM-based Prompt Translation and LoRA Fine-Tuning


188. CollabBench: Benchmarking and Unleashing Collaborative Ability of LLMs with Diverse Players via Proactive Engagement


189. Next-Generation Parallel Decoder for LPDR: Architectural Optimization and Class-Balanced GAN-Augmentation


190. TinyML-Driven Cybersecurity for Autonomous Spacecraft: Latency-Accuracy Analysis for SPARTA RF and Cyber Threat Detection


191. An Improved CNN-LSTM Based Intrusion Detection System for IoT Networks


192. Human Oversight and Overload: Two Hidden and Costly Burdens of AI-Assisted Software Engineering


193. DRIFT: A Residual Flow Adapter for Decoding Continuous Outputs in Vision-Language Models


194. Beyond Soft Masks: Hard-Perturbation Mixup Explainer for Robust GNN Explainability


195. SagnacAssisted Enhanced OTDR for Distributed Acoustic Sensing: A Standardized Benchmark and Engineering Evaluation Framework


196. MARDoc: A Memory-Aware Refinement Agent Framework for Multimodal Long Document QA


197. UNIVID: Unified Vision-Language Model for Video Moderation


198. Let It Be Simple: One-Step Action Generation for Vision-Language-Action Models


199. Narrative Knowledge Weaver: Narrative-Centric Retrieval-Augmented Reasoning for Long-Form Text Understanding


200. Microskill Architecture: A Modular Skill-Driven Framework for AI-Native Code Generation


201. ViCuR: Visual Cues as Recoverable Privilege for Multimodal On-Policy Distillation


202. Explainable AI-Driven Cyber Risk Analytics and Model Reliability Assessment for Intelligent Governance of U.S. Critical Infrastructure: An XGBoost and SHAP-Based Intrusion Detection Framework


203. Cognitive Threat Intelligence and Explainable Federated Security Analytics for distributed Infrastructure Systems


204. Benchmarking Counterfactual Prediction in Epidemic Time Series with Time-Varying Interventions


205. Value-and-Structure Alignment for Routing-Consistent Quantization of Mixture-of-Experts Models


206. Data Flow Control: Data Safety Policies for AI Agents


207. Beyond Waveform Robustness: Robust Feature-Vocoder Adversarial Attacks on Automatic Speech Recognition


208. LongSpace: Exploring Long-Horizon Spatial Memory from Perception to Recall in Video


209. Safe Embodied AI for Long-horizon Tasks: A Cross-layer Analysis of Robotic Manipulation


210. Agent-Orchestrated Adaptive RAG: A Comparative Study on Structured and Multi-Hop Retrieval


211. When Surface Form Changes Moderation Decisions: A Paired Study of Code-Mixed Workflow Instability


212. Enhancing Software Engineering Through Closed-Loop Memory Optimization


213. When New Generators Arrive: Lifelong Machine-Generated Text Attribution via Ridge Feature Transfer


214. SlotGCG: Exploiting the Positional Vulnerability in LLMs for Jailbreak Attacks


215. The End of Software Engineering: How AI Agents Are Fundamentally Restructuring the Software Paradigm


216. Cross-Epoch Adaptive Rollout Optimization for RL Post-Training


217. HDST-GNN: Heterogeneous Dynamic Spatiotemporal Graph Neural Networks for Multi-Object Tracking in UAV Aerial Imagery


218. Dimensionality Reduction for Cyberattack Classification: A Comparative Evaluation of PCA and Linear Predictive Coding


219. TensorBench: Benchmarking Coding Agents on a Compiler-Based Tensor Framework


220. InfoShield: Privacy-Preserving Speech Representations for Mental Health Screening via Information-Theoretic Optimization


221. Representation Learning Enables Scalable Multitask Deep Reinforcement Learning


222. ArcANE: Do Role-Playing Language Agents Stay in Character at the Right Time?


223. Balancing Image Compression and Generation with Bootstrapped Tokenization


224. Conformal Risk-Averse Decision Making with Action Conditional Guarantee


225. ADK Arena: Evaluating Agent Development Kits via LLM-as-a-Developer


226. Noise-Aware Visual Representation Learning for Medical Visual Question Answering


227. What Objects Enable, Not What They Are: Functional Latent Spaces for Affordance Reasoning


228. Almieyar-Oryx-BloomBench: A Bilingual Multimodal Benchmark for Cognitively Informed Evaluation of Vision-Language Models


229. Exploring LLMs for South Asian Music Understanding and Generation


230. The Role of Instructional Guidance in Generative AI-Assisted Learning: Empirical Evidence from Construction Engineering Education


231. MASF: A Multi-Model Adaptive Selection Framework for Abstractive Text summarization


232. Towards Unified and Data-Efficient Prognostics and Health Management with Tabular Foundation Models


233. Multilingual Coreference Resolution via Cycle-Consistent Machine Translation


234. GOTabPFN: From Feature Ordering to Compact Tokenization for Tabular Foundation Models on High-Dimensional Data


235. Selective-Advantage Entropy-Adaptive Horizon GRPO: Asymmetric Token-Level Discounting for Efficient Reinforcement Learning of Language Models


236. Executable Schema Contracts: From Automatic Ingestion to Multi-Source Retrieval


237. When Evidence is Sparse: Weakly Supervised Early Failure Alerting in Dialogs and LLM-Agent Trajectories


238. CausalPOI: Spatio-Temporal Graph-Based Causal Modeling for Cold-Start POI Check-in Forecasting


239. Trust, but Don’t Verify: Epistemic Blind Spots in LLM Source Evaluation


240. ReasoningFlow: Discourse Structures for Understanding LLM Reasoning Traces


241. Willing but Unable: Separating Refusal from Capability in Code LLMs via Abliteration


242. VASO: Formally Verifiable Self-Evolving Skills for Physical AI Agents


243. Human oversight of agentic systems in practice: Examining the oversight work, challenges, and heuristics of developers using software agents


244. Can AI Refute Economic Theory? Evidence from Beyond the Knowledge Cutoff


245. Pattern Selectivity is Not Task-Causal Structure: A Cross-Architecture Mechanistic Study of Composed-Task Circuits in 1B-Class Language Models


246. Three-Dimensional Retinal Microvasculature Restoration in OCT Angiography


247. A Taxonomy of Runtime Faults in Model Context Protocol Servers


248. A Model of Multi-turn Human Persuadability Using Probabilistic Belief Tracing


249. The Invisible Hand of Physics: When Video Diffusion Models Know More Than They Show


250. Gradient descent at the Edge of Stability: free energy model and kinetic description of the two-layer network


251. LoRi: Low-Rank Distillation for Implicit Reasoning


252. Statistically Reliable LLM-Based Ranking Evaluation via Prediction-Powered Inference


253. Agentic Monte Carlo: Simulating Reinforcement Learning for Black-Box Agents


254. Do Models Share Safety Representations? Cross-Model Steering for Safe Visual Generation


255. Personal AI Agent for Camera Roll VQA


256. Policy-Conditioned Counterfactual Credit for Verifiable Reinforcement Learning of Long-Horizon Language Agents


257. X-Band UAV-enabled Integrated Sensing and Communications for Vehicular Networks


258. NIV: Neural Axis Variations for Variable Font Generation


259. From Attack Simulation to SIEM Rule: Deterministic Detection-as-Code Synthesis with Probe-Level Traceability


260. Search-Time Contamination in Deep Research Agents: Measuring Performance Inflation in Public Benchmark Evaluation


261. Domain-Conditioned Safety in Frontier Computer-Using Agents: A 793-Episode Browser Benchmark, a Coding-Domain Cross-Reference, and a Reproducibility Audit of Recent Red-Teaming



263. Where’s the Structure? A Systematic Literature Review of Empirical Research on Human-AI Collaboration and Hybrid Intelligence for Learning


264. Gradient Descent with Large Step Size Restores Symmetry in Deep Linear Networks with Multi-Pathway


265. The Score Hamiltonian: Mapping Diffusion Models to Adiabatic Transport


266. Ontology-constrained multi-LLM scoring of hypothesis support in the predictive processing literature


267. Finite Element-Based Material Learning via Automatic Differentiation: Learning constitutive neural network models from full-field deformation data


268. Temporal Preference Concepts and their Functions in a Large Language Model


269. Assessing the Geographic Diversity of AI’s Platial Representations in Image Generation


270. Geographic Bias and Diversity in AI Evaluation


271. The Granularity Gap: A Multi-Dimensional Longitudinal Audit of Sycophancy in Gemini Models


272. Multi-Granularity Reasoning for Natural Language Inference


273. From Scoring to Explanations: Evaluating SHAP and LLM Rationales for Rubric-based Teaching Quality Assessment


274. The Virtual Roundtable: Multi-Agent Personas Simulating the Dynamics of Human Brainstorming


275. MCBench: A Multicontext Safety Assessment Benchmark for Omni Large Language Models


276. PEFT of SLM for Telecommunications Customer Support: A Comparative Study of LoRA Configurations with Energy Consumption Analysis


277. Improving Heart-Focused Medical Question Answering in LLMs via Variance-Aware Rubric Rewards with GRPO


278. Predict and Reconstruct: Joint Objectives for Self-Supervised Language Representation Learning


279. Epidemiology of Model Collapse: Modeling Synthetic Data Contamination via Bilayer SIR Dynamics


280. RAINO: Anchoring Agents in Reality, A Systematic Review and Conceptual Framework for Realism in Agent-Based Modelling