전체 AI 논문 - 2026-06-03

1. Imaginative Perception Tokens Enhance Spatial Reasoning in Multimodal Language Models


2. Entropy Is Not Enough: Unlocking Effective Reinforcement Learning for Visual Reasoning via Vision-Anchored Token Selection


3. Hedge-Bench: Benchmarking Agents on Hard, Realistic Tasks Pertaining to Financial Reasoning


4. scTranslation: A Comprehensive Benchmark for Single-Cell Multi-Omics Modality Translation


5. Reasoning Structure of Large Language Models


6. PyraMathBench: Evaluating and Improving Mathematical Capability in Large Language Models


7. EvoDS: Self-Evolving Autonomous Data Science Agent with Skill Learning and Context Management


8. BigFinanceBench: A Workflow-Grounded Benchmark for Financial-Research Agents


9. Calibrating Urban Traffic Simulation from Sparse Road Observations via Genetic Optimization


10. Leveraging BART to Assess CS1 C++ Programming Assignments using Rubric-based Criteria


11. Enhancing Operational Safety via Agentic Dialogue Hazard Identification Analysis


12. From Control Boundary to Insurance Claim: Reconstructing AI-Mediated Losses Through the CER Framework


13. LAP: An Agent-to-Instrument Protocol for Autonomous Science


14. Proof-Refactor: Refactoring Generated Formal Proofs into Modular Artifacts


15. When to Re-Plan: Subgoal Persistence in Hierarchical Latent Reasoning


16. Unveiling the Structure of Do-Calculus Reasoning via Derivation Graphs


17. Code-on-Graph: Iterative Programmatic Reasoning via Large Language Models on Knowledge Graphs


18. Dynamic Objective Selection with Safeguards and LLM Oversight for Financial Decision-Making


19. SkillPyramid: A Hierarchical Skill Consolidation Framework for Self-Evolving Agents


20. The DeepSpeak-Agentic Dataset


21. EvoDrive: Pareto Evolution for Safety-Critical Autonomous Driving via Self-Improving LLM Agents


22. From Answers to States: Verifiable Process-Level Evaluation of Chemical Reasoning in Large Language Models


23. Diagnosing Knowledge Gaps in LLM Tool Use: An Agentic Benchmark for Novel API Acquisition


24. Towards Non-Monotonic Entailment in Propositional Defeasible Standpoint Logic


25. Gender-Dependent Diagnostic Substitution in LLM Medical Triage: Same Symptoms, Unequal Urgency


26. TSQAgent: Rating Time Series Data Quality via Dedicated Agentic Reasoning


27. Bridging Auxiliary Constraints to Resolve Instruction Following in Large Reasoning Models


28. Cross-Lingual Token Arbitrage: Optimizing Code Agent Context Windows via Local LLM Preprocessing


29. From Prompt to Service: An SLM-Based Agent Orchestration Gateway for AI-Driven Virtual Worlds


30. SAGE: A Quantitative Evaluation of Socialized Evolution in Agent Ecosystems


31. Overlaying Governance: A Compositional Authorization Framework for Delegation and Scope in Agentic AI


32. ThoughtFold: Folding Reasoning Chains via Introspective Preference Learning


33. A formal definition and meta-model for a machine theory of mind


34. StepFinder: A Temporal Semantic Framework for Failure Attribution in Multi-Agent Systems


35. DMF: A Deterministic Memory Framework for Conversational AI Agents


36. What Makes Interaction Trajectories Effective for Training Terminal Agents?


37. CP-Agent: Context-Aware Multimodal Reasoning for Cellular Morphological Profiling under Chemical Perturbations


38. InfoMem: Training Long-Context Memory Agents with Answer-Conditioned Information Gain


39. The Violation Situation Pattern: A Knowledge-Graph Pattern for Compliance Violations


40. The Reliability Gap in Benchmark Auditing: Distribution Shift and Scale as Failure Modes of Contamination Detection


41. LEAP: Supercharging LLMs for Formal Mathematics with Agentic Frameworks


42. A Negative Result on Cross-Model Activation Transfer in a Pythia Multi-Hop Setting


43. Distilling Answer-Set Programming Rules from LLMs for Neurosymbolic Visual Question Answering


44. Do Real-World Datasets Contain Natural Experiments? An Empirical Study Using Causal Feature Selection


45. Solipsistic Superintelligence is Unlikely to be Cooperative


46. Perceive Before Reasoning: A Pre-Reasoning Perception Framework for Efficient and Reliable Proactive Mobile Agents


47. Effect of Demographic Bias on Skin Lesion Classification


48. MedCUA-Bench: A Screenshot-Only Benchmark for Clinical Computer-Use Agents


49. ClinicalMC: A Benchmark for Multi-Course Clinical Decision-Making with Large Language Models


50. GTBench: A Curriculum-Grounded Benchmark for Evaluating LLMs as Mathematical Research Assistants in Graph Theory


51. Think-Before-Speak: From Internal Evaluation to Public Expression in Multi-Agent Social Simulation


52. Uncertainty-Aware Clarification in LLM Agents with Information Gain


53. EvoTrainer: Co-Evolving LLM Policies and Training Harnesses for Autonomous Agentic Reinforcement Learning


54. DeskCraft: Benchmarking Desktop Agents on Professional Workflows and Human-in-the-Loop Collaboration


55. From Long News to Accurate Forecast: Importance-Aware Fusion and PRM-Guided Reflection for Time Series Forecasting


56. Decomposing how prompting steers behavior


57. The Shadow Price of Reasoning: Economic Perspective on Optimal Budget Allocation for LLMs


58. DELTAMEM: Incremental Experience Memory for LLM Agents via Residual Trees


59. CORE: Conflict-Oriented Reasoning for General Multimodal Manipulation Detection


60. SkillDAG: Self-Evolving Typed Skill Graphs for LLM Skill Selection at Scale


61. ToolGate: Token-Efficient Pre-Call Control for Tool-Augmented Vision-Language Agents


62. RelGT-AC: A Relational Graph Transformer for Autocomplete Tasks in Relational Databases


63. TriEval: A Resource-Efficient Pipeline for LLM Bias, Toxicity, and Truthfulness Assessment


64. AUDITFLOW: Executable Symbolic Environments for Structured Financial Reporting Verification


65. Inducing Reasoning Primitives from Agent Traces


66. WISE-HAR: A Generalizable Ensemble Deep Learning Framework for WiFi-Based Human Activity Recognition


67. What Benchmarks Don’t Measure: The Case for Evaluating Abstention Competence in Autonomous Agents


68. Large AI Models in Dental Healthcare: From General-Purpose Systems to Domain-Specific Foundation Models


69. Handoff Debt: The Rediscovery Cost When Coding Agents Take Over Interrupted Tasks


70. When Helping Hurts and How to Fix It: Multi-Agent Debate for Data Cleaning


71. Don’t Gamble, GAMBLe: An Analytical Framework for AI-Driven Research Systems


72. Toward a Modular Architecture for Embedded AI Agent Systems at the Edge


73. Thinking Past the Answer: Evaluating Harmful Overthinking in Large Reasoning Models


74. An Exploration of Collision-based Enemy Morphology Generation


75. Traj-Evolve: A Self-Evolving Multi-Agent System for Patient Trajectory Modeling in Lung Cancer Early Detection


76. ChatHealthAI: Aligning Electronic Health Record Representations with Large Language Models for Grounded Clinical Reasoning


77. BehaviorBench: Modeling Real-World User Decisions from Behavioral Traces


78. Evaluating Transformer and LSTM Frameworks for Prediction in Ungauged Basins


79. AURA: Action-Gated Memory for Robot Policies at Constant VRAM


80. Visual Graph Scaffolds for Structural Reasoning in Large Language Models


81. Humanoid-GPT: Scaling Data and Structure for Zero-Shot Motion Tracking


82. Language Models Need Sleep: Learning to Self-Modify and Consolidate Memories


83. Formalizing the Binding Problem


84. Quantifying Faithful Confidence Expression in Large Reasoning Models


85. QUBRIC: Co-Designing Queries and Rubrics for RL Beyond Verifiable Rewards


86. AlignAtt4LLM: Fast AlignAtt for Decoder-Only LLMs at IWSLT 2026 Simultaneous Speech Translation Task


87. Agentic Chain-of-Thought Steering for Efficient and Controllable LLM Reasoning


88. Self-Refining Agentic Reinforcement Learning for Vision-Conditioned UAV Navigation


89. Using Reward Uncertainty to Induce Diverse Behaviour in Reinforcement Learning


90. Efficient ASR Training with Conversations that Never Happened


91. FlashbackCL: Mitigating Temporal Forgetting in Federated Learning


92. q0: Primitives for Hyper-Epoch Pretraining


93. FFR: Forward-Forward Learning for Regression


94. NetKV: Network-Aware Decode Instance Selection for Disaggregated LLM Inference


95. The Impact of Configuring Agentic AI Coding Tools on Build-vs-Buy Decisions: A Study Protocol


96. Agent libOS: A Library-OS-Inspired Runtime for Long-Running, Capability-Controlled LLM Agents


97. Synthesize and Reward – Reinforcement Learning for Multi-Step Tool Use in Live Environments


98. Beyond Encoder Accumulation: Measuring Encoder Roles in Multi-Encoder VLMs


99. From ‘What’ to ‘How’ and ‘Why’: Sharing LLM-Generated Retrospective Summaries of Older Adults’ Passive Tracking Data with Remote Family Members


100. A Training-Free Mixture-of-Agents Framework for Multi-Document Summarization using LLMs and Knowledge Graphs


101. Taiji: Pareto Optimal Policy Optimization with Semantics-IDs Trade-off for Industrial LLM-Enhanced Recommendation


102. FLARE: Fine-Grained Diagnostic Feedback for LLM Code Refinement


103. Clustered Self-Assessment: A Simple yet Effective Method for Uncertainty Quantification in Large Language Models


104. Re-Evaluating Continual Learning with Few-Shot Adaptation


105. Conditional Latent Diffusion Model with Fourier-based Motion Modelling for Virtual Population Synthesis


106. AI Agents Enable Adaptive Computer Worms


107. Consistency Training Can Entrench Misalignment


108. PURGE: Projected Unlearning via Retain-Guided Erasure


109. LiveBand: Live Accompaniment Generation in the Audio Domain


110. Trading Human Curation for Synthetic Augmentation in RLVR


111. Signed Spiking Neuron Enabled by an Orthogonal-Easy-Axis Magnetic Tunnel Junction


112. E2LLM: Towards Efficient LLM Serving in Heterogeneous Edge/Fog Environments


113. Merit or networks? What decides where research is published


114. Tool-Aware Optimization with Entropy Guidance for Efficient Agentic Reinforcement Learning


115. Ultralytics YOLO26: Unified Real-Time End-to-End Vision Models


116. Qwen-Image-Flash: Beyond Objective Design


117. Staying Alive: Uncensored Survival Analysis with Tabular Foundation Models


118. A Close Look At World Model Recovery In Supervised Fine-Tuned LLM Planners


119. AUGUSTE: Online-Learning dApp for Predictive URLLC Scheduling


120. CoEval: Ranking Language Models for Custom Tasks Without Labeled Data or Trustworthy Benchmarks


121. Safety Measurements for Fine-tuned LLMs Should be Grounded in Capability


122. Black-box, Adaptive, Efficient, Transferable, Harmful, Applicable… Attacks Are All You Need to Break LLMs


123. The Shape of Addition: Geometric Structures of Arithmetic in Large Language Models


124. VidMsg: A Benchmark for Implicit Message Inference in Short Videos


125. AnchorMoE: Interpretable Time Series Classification via Anchor-Routed MoE


126. Building Reliable Long-Form Generation via Hallucination Rejection Sampling


127. TurtleAI: Benchmarking Multimodal Models for Visual Programming in Turtle Graphics


128. Physics-Guided Policy Optimization with Self-Distillation


129. Exploiting Verification-Generation Gap: Test-Time Reinforcement Learning with Confidence-Conditioned Verification


130. Testing LLM Arithmetic Reasoning Generalization with Automatic Numeric-Remapping Attacks


131. CauTion: Knowing When to Trust LLMs for Ensemble Causal Discovery


132. DDOR: Delta Debugging for Explainable Overrefusal Testing and Repair


133. PHASER: Phase-Aware and Semantic Experience Replay for Vision-Language-Action Models


134. When Attention Collapses: Stage-Aware Visual Token Pruning from Structure to Semantics


135. Learned Non-Maximum Suppression for 3D Object Detection


136. Efficient Transformer-Based Localized Patch Sampling for Choroid Plexus Segmentation in Multiple Sclerosis


137. \textsc{CR-Seg}: Attention-Guided and CoT-Enhanced Coarse-to-Refined Reasoning Segmentation


138. When Should the Teacher Move? Temporal Coupling and Stability in Self On-Policy Distillation


139. High-Precision APT Malware Attribution with Out-of-Scope Resilience


140. Post-Hoc Robustness for Model-Based Reinforcement Learning


141. Scalable On-Hardware Training of Quantum Neural Networks and Application to Clinical Data Imputation


142. SPADE: Sketch-guided Path Planning Augmented with Diffusion Experts


143. BaltiVoice: A Speech Corpus and Fine-tuned Whisper ASR System for the Balti Language


144. Learn from Your Mistakes: Tree-like Self-Play for Secure Code LLMs


145. NeuroArmor: Safe-Variant-Guided Representation Consistency for Selective Re-Anchoring in Jailbreak Defense


146. Analyzing Stream Collapse in Hyper-Connections: From Diagnosis to Mitigation


147. Rethinking the Role of Tensor Decompositions in Post-Training LLM Compression


148. Tonal parsimony in chord-sequence analysis: combining modulation cost and tonal vocabulary


149. FORGE: Multi-Agent Graduated Exploitation and Detection Engineering


150. PRISM: Synergizing Vision Foundation Models via Self-organized Expert Specialization


151. A Hybrid Approach For Malware Classification Using Secondary Features Fusion


152. FlowGuard: Flow Matching for Identity-Independent Detection of Data-Free Model Stealing Attacks on Energy System Intrusion Detection Systems


153. PrimeSVT: An Automated Memory-aware Pruning Framework with Prioritized Compression Policy for Spiking Vision Transformers


154. Optimizing Explicit Unit-Distance Lower-Bound Certificates


155. Causal Evidence of Stack Representations in Modeling Counter Languages Using Transformers


156. When Model Merging Breaks Routing: Training-Free Calibration for MoE


157. Grasp-Then-Plan with Failure Attribution: A Closed Two-Stage Framework for Precise and Generalizable Robotic Manipulation


158. Local Guidance, Global Impact: Gaussian-Reshaped Trust Region Unlocks Behavior Transitions


159. AI Model Extraction Attacks: Bypassing Single-Client Assumptions in Defenses


160. P\textsuperscript{2}-DPO: Grounding Hallucination in Perceptual Processing via Calibration Direct Preference Optimization


161. The Unsampled Truth: Psychometrics in SLMs Measure Prompt Artifacts, Not Psychological Constructs


162. SynCred-Bench: Benchmarking Synthetic Credibility in AI-Generated Visual Misinformation


163. AugMask: Training Diffusion Models on Incomplete Tabular Data via Stochastic Augmentation and Masking


164. Evaluating LLMs’ Effectiveness on Real-World Consumer Device Repair Questions


165. FLIPS: Instance-Fingerprinting for LLMs via Pseudo-random Sequences


166. Calibration Data Trade-offs Across Capability Dimensions: Why Multi-Source Mixing Matters for High-Sparsity LLM Pruning


167. dstack-capsule: Pod-Level Remote Attestation for Confidential Workloads on Kubernetes


168. Multi-Modal Graph Neural Network with Transformer-Guided Adaptive Diffusion for Preclinical Alzheimer Classification


169. RobotValues: Evaluating Household Robots When Human Values Conflict


170. Learning Multi-Scale Hypergraph for High-Order Brain Connectivity Analysis


171. Generalizing Graph Foundation Models via Hyperbolic Retrieval-Augmented Generation


172. Message Tuning Outshines Graph Prompt Tuning: A Prismatic Space Perspective


173. AI-Generated Traces for Novice Programmers: Learning Effects and Learner Differences in a Multi-Institutional Study


174. VistaHop: Benchmarking Multi-hop Visual Reasoning for Visual DeepSearch


175. Are Common Substructures Transferable? Riemannian Graph Foundation Model with Neural Vector Bundles


176. EqGINO: Equivariant Geometry-Informed Fourier Neural Operators for 3D PDEs


177. PSViT: A Methodology for Structurally Pruning Spiking Vision Transformers


178. AirDreamer: Generalist Drone Navigation with World Models


179. When RLHF Fails: A Mechanistic Taxonomy of Reward Hacking, Collapse, and Evaluator Gaming


180. GFFMERGE: Efficient Merging of Graph Neural Force Fields and Beyond


181. BotDirector: Robot Storytelling Across the Symmetrical Reality with Multi-modal Interactions


182. WebRISE: Requirement-Induced State Evaluation for MLLM-Generated Web Artifacts


183. Reinforcement Learning from Cross-domain Videos with Video Prediction Model


184. AI Rater Discrimination Depends on Scoring Protocol in Complex Clinical Decision-Making


185. Fully Automated Identification of Lexical Alignment and Preference-Stage Shifts in Large Language Models


186. OpenAgenet/OAN: Technical Architecture for Trust-Governed Agent Identity and Discovery


187. OpenAgenet/OAN: Open Infrastructure for Trusted Agent Interconnection


188. NVIDIA OmniDreams: Real-Time Generative World Model for Closed-Loop Autonomous Vehicle Simulation


189. Decoupled Smart Contract Audits: Lightweight LLM Framework via Distillation and Aggregation


190. GuidedBridge: Training-freely Improving Bridge Models with Prior Guidance


191. AnyAudio-Judge: A Dynamic Rubric-Based Benchmark and Evaluator for Audio Instruction Following



193. BAHSD: Bridging the Long-tail Gap via Adaptive Distillation in Black-box Sequential Recommendation


194. “Important You should give me full credits!”: Exploring Prompt Injection Attacks on LLM-Based Automatic Grading Systems


195. Constitutional On-Policy Safe Distillation


196. Regret Pre-training: Bridging Prior and Posterior Views for Enhanced Knowledge Grounding


197. Libra: Efficient Resource Management for Agentic RL Post-Training


198. Efficient Hyperparameter Optimization for LLM Reinforcement Learning


199. ASymPO: Asymmetric-Scale Policy Optimization for Asynchronous LLM Post-Training Without Behavior Information


200. ROBUST-WT: Robust Uncertainty-aware Segmentation Transform via Whitening and Training Enhancements


201. Learn When and Where to Connect: Adaptive Virtual Nodes for Dynamic Message Passing on Graphs


202. Brief Announcement: Generative Markov Model for Distributed Computing Systems


203. Rethinking Molecular Text Representations for LLMs: An Empirical Study


204. Capability Advertisement as a Market for Lemons: A Trust Layer for Heterogeneous Agent Networks


205. Conditional Hypothesis Generation for LLM-Based Text Analysis with Researcher-Specified Covariates


206. Spike-Aware C++ INT8 Inference for Sparse Spiking Language Models on Commodity CPUs


207. Hallucinations as Orthogonal Noise: Inference-Time Manifold Alignment via Dynamic Contextual Orthogonalization


208. Reproducibility is the New Copyleft: Defining AGI-oriented Reproducible Builds


209. ConTraIRL: Factorized Contrastive Abstractions for Transferable IRL


210. MUSE: A Unified Agentic Harness for MLLMs


211. Exact equivariance, kept through training, buys zero-shot generalisation across the symmetry group


212. How Quantization Changes Interpretable Features: A Sparse Autoencoder Analysis of Language Models


213. Patcher: Post-Hoc Patching of Backdoored Large Language Models


214. Pretraining Language Models on Historical Text


215. Towards Compact Autonomous Driving Perception with Balanced Learning and Multi-sensor Fusion


216. Glass Box at Orbit: A Constitutional AI Verification Framework for Trustworthy Autonomous CubeSat Intelligence


217. Hand Trajectory Fusion for Egocentric Natural Language Query Grounding


218. Echelon: Auditable Aggregate-Only Language-Model Adaptation Across Privacy Boundaries


219. Fast-dLLM++: Fréchet Profile Decoding for Faster Diffusion LLM Inference


220. SCOPE: Real-Time Natural Language Camera Agent at the Edge


221. WRIT: Write-Read Intensive Trajectory Synthesis for Multi-Turn User-Facing Agents


222. Linear Probes Detect Task Format, Not Reasoning Mode in Language Model Hidden States


223. Scalable Uncertainty Quantification for Extreme Weather Forecasting via Empirical Neural Tangent Kernels


224. Are we really tilting? The mechanics of reward guidance in flow and diffusion models


225. LLM-Assisted Reranking to Operationalize Nuanced Objectives in Recommender Systems


226. Adaptive Latent Agentic Reasoning


227. The Epi-LLM Framework: probing LLM behavioral priors through epidemiological agent-based models


228. Forgetting is Not Erasure: Recovering Latent Knowledge via Transport Keys


229. Economy of Minds: Emerging Multi-Agent Intelligence with Economic Interactions


230. GRZO: Group-Relative Zeroth-Order Optimization for Large Language Model Fine-Tuning


231. Fixing FOLIO and MALLS: Verified Annotations and an LLM-assisted Framework to Focus Human Relabeling


232. Large Byte Model: Teaching Language Models About Compiled Code


233. Which Defense Closes Which Threat? Attributing OWASP-LLM-Top-10 Coverage and Its Brittleness Under Paraphrasing


234. Do Neural Retrievers Prefer Certain Documents? Evidence of Learned Relevance Priors


235. Cosmos 3: Omnimodal World Models for Physical AI


236. CRAM-ER: Error-Resilient Spintronic Computational Random Access Memory for Scalable In-Memory Computation


237. Representational Capacity: Geometric Limits on Feature Representation in Transformer Language Models


238. Acceptance-Test-Driven Evaluation Protocols for Business-Centric LLM Systems


239. MetaWorld: Scaling Multi-Agent Video World Model from Single-view Video Data


240. Plan2Map: A Multimodal Benchmark for Document-Grounded Geospatial Boundary Reconstruction from Planning Records


241. EntangleCodec: A Unified Discrete Audio Tokenizer via Semantic-Acoustic Entanglement


242. Attention Calibration for Position-Fair Dense Information Retrieval


243. See Less, Specify More: Visual Evidence Budgets for Generalizable VLAs


244. AVTrack: Audio-Visual Tracking in Human-centric Complex Scenes


245. Filter, Then Reweight: Rethinking Optimization Granularity in On-Policy Distillation


246. Aligning Data-Driven Predictors with Allocation: A Decision-Focused Approach to Survival Analysis


247. Anomalies in Multivariate Time Series Benchmarks Are Mostly Univariate


248. AdaWeather: Adaptively Mixing Probabilistic Weather Forecasts with Logarithmic Regret


249. Improvise, Adapt, Overcome: An On-The-Fly Multifidelity Algorithm for Efficient Machine Learning


250. Learning to Refine: Spectral-Decoupled Iterative Refinement Framework for Precipitation Nowcasting


251. CL-DMDF:Dynamic Multimodal Data Fusion Model Based on Contrastive Learning


252. The Ringelmann Effect in Multi-Agent LLM Systems: A Scaling Law for Effective Team Size


253. Target Updates May Stabilize Linear Q-Learning: Periodic and Soft Dynamics


254. A New Framework for Cybersecurity Refusals in AI Agents


255. Inference Cost Attacks for Retrieval-Augmented Large Language Models


256. SVHalluc: Benchmarking Speech-Vision Hallucination in Audio-Visual Large Language Models


257. CARVE: Certified Affordable Repair of Vetoed Maneuvers via Envelopes for Interactive Driving


258. D-Judge: Disrupting Multi-Turn Jailbreaks using Semantics-Preserving Output Rewriting


259. Sparse-View Lung Nodule Volumetry from Digitally Reconstructed Radiographs via AReT: Anatomy-Regularized TensoRF


260. SegTune: Structured and Fine-Grained Control for Song Generation


261. Too Much of a Good Thing: When sim2real Efforts Impede Policy Learning (And What to Do About It)


262. Echo-POSED: Geometric Self-Distillation for Echocardiography Guidance


263. Position: Prioritize Identifying Structure, Not Complex Models, for Scientific Discovery


264. Wavelet as Tokenizer: Preliminary Results on a Shared Wavelet Token Schema for Natural Signals


265. MultiTurnPSB: Evaluating Multi-Turn Jailbreak Attacks an dClassifier-Based Defenses for Medical AI Safety


266. Enhancing Protein-Protein Interaction Prediction with Hierarchical Motif-based Multimodal Protein Embedding


267. DXA-Derived Skeletal Phenotypes and Hip Fracture Risk: A Backdoor-Adjusted Causal Analysis


268. TadA-Bench: A Million-Variant Benchmark for Future-Round Discovery Toward Agentic Protein Engineering


269. Oscillatory State-Space Models as Inductive Biases for Physics-Informed Neural PDE Solvers


270. Closed-Loop Molecular Design with Calibrated Deference


271. FSA-GRPO: Teaching Auditory LLMs to Use Few-shot Demonstrations


272. Margin Play: A Multi-Agent System For Public Policy Analysis In The Brazilian Equatorial Margin


273. Samudra 2: Scaling Ocean Emulators across Resolutions


274. Building Better Activation Oracles


275. Geometry-Aware Tabular Diffusion


276. ReLoRA: Knowledge-Reusing Adaptation for Fast Rollout of Evolving LLM Services


277. Cross-Modal Contrastive Learning of ECG and Angiography Representations for Severe Stenosis Classification


278. Auditable Climate Risk Intelligence from Fragmented ESG Data: Deterministic Orchestration and Imbalance-Aware Learning for Scope 1-3 Validation


279. Tracking Urban Atmospheric Pollutants using Sentinel-5P Satellite Data


280. Lean-GAP: A Dataset of Formalized Graduate Algebra Problems


281. IdiomX A Multilingual Benchmark for Idiom Understanding, Retrieval, and Interpretation


282. Cost-Aware Query Routing in RAG: Empirical Analysis of Retrieval Depth Tradeoffs


283. TRAP: Hijacking VLA CoT-Reasoning via Adversarial Patches