AI News

⚡ 9 minutes ago
1
1
A Few Words Go a Long Way: Language Guided Robot Policy Synthesis (arxiv.org)
2
1
D-Score: A Spectral Hidden-State Signal for Hallucination Detection in Large Language Models (arxiv.org)
3
1
Neptuna: A Comprehensive Machine Learning Framework for Benchmarking Complex Multiphase Flows (arxiv.org)
4
1
Opaque Epistemic Mediation: How LLM Deployment Configurations Shape the Validation of Pseudo-Science (arxiv.org)
5
1
Maximum Satisfiability of Simple Temporal Problems (arxiv.org)
6
1
TRACE-CTI: Auditable Post-Extraction Governance of TTP Claims with Knowledge Graphs (arxiv.org)
7
1
Neural Message-Passing on Attention Graphs for Hallucination Detection (arxiv.org)
8
1
Event Driven Clustering Algorithm (arxiv.org)
9
1
KANEx: Translating Kolmogorov-Arnold Networks' Interpretability to Medical Explainability (arxiv.org)
10
1
IKS-Instruct: A 24,000-Example Multilingual Dataset for Teaching Language Models Indian Knowledge Systems (arxiv.org)
11
1
Quantum Safe-Set Bayesian Optimization for Quality Improvement in Fuselage Assembly (arxiv.org)
12
1
The Visual Bottleneck: Sparse-Frame Adaptation of MLLMs for Joint Spatial-Temporal Video Grounding (arxiv.org)
13
1
Making Mathematical Knowledge Explainable, Accessible and Interoperable Through Large Language Model Integration (arxiv.org)
14
1
LLM-Assisted Ontology Engineering and Construction of a French Legal Knowledge Graph (arxiv.org)
15
1
Neonatal Hypoxic-ischaemic Encephalopathy Classification from the EEG and HRV Signals Using a Conformer based Masked Autoencoder (arxiv.org)
16
1
Infinite-Precision Autoregressive Modeling for Vector Graphics and Layouts (arxiv.org)
17
1
From Execution to Capability: Scientific Experience Consolidation via Procedural Knowledge Synthesis (arxiv.org)
18
1
Gubernaut: A Deterministic Homeostatic Controller for Affect-Regulated LLM Agents, Validated Across Independent Model Families (arxiv.org)
19
1
Variational-Ising-Attention (VIA):TailoredAttentionMattersfor Science (arxiv.org)
20
1
Procedural Content Generation via Generative Artificial Intelligence (arxiv.org)
21
1
Failures Reveal What Metrics Miss: An Evidence-Driven Agent for Recursive Refinement of ECG Classifiers (arxiv.org)
22
1
MIME: Multimodal Interactive Motion Encoder (arxiv.org)
23
1
Task-Conditional Faithfulness Auditing of Multimodal LLMs for Grid Diagnosis (arxiv.org)
24
1
LLM-SoccerArena: Benchmarking LLMs on Real-World Predictions in Sports (arxiv.org)
25
1
EditCLEVR: A Paired-Scene Intervention Benchmark for Compositional Faithfulness of Object-Centric Representations (arxiv.org)
26
1
Unequal Trips, Unequal Places: Diagnosing and Mitigating Delay Inequity in Autonomous Vehicle Fleet Coordination (arxiv.org)
27
1
Visual Token Compression Enhances Robustness of MLLMs (arxiv.org)
28
1
A New Kind of Adversarial Example: Measuring the Human-Model Gap, and Its Relationship to OOD Detection (arxiv.org)
29
1
AutoCluster, AutoTopicModeling, AutoTrendAnalysis: A Complete AutoML Pipeline for Predicting Emerging Trends (arxiv.org)
30
1
Simulating Tenant Responses to Energy Policy Interventions with Transaction-Cost-Aware LLM Age (arxiv.org)
31
1
Reconstruction of SINR Maps from Sparse Measurements using Group Equivariant Non-Expansive Operators (arxiv.org)
32
1
Are Prompt Optimizers Blind? Cross-Modal Visual Feedback for Automatic Prompt Optimization (arxiv.org)
33
1
Extending Desbordante with Probabilistic Functional Dependency Discovery Support (arxiv.org)
34
1
Visible-Light Imaging Diagnosis of Neutral Particle Emission Tomography in the Tokamak Divertor: An Efficient Transformer-based Surrogate Model (arxiv.org)
35
1
Hierarchical Group-Conditional Conformal Risk Control for Selective Prediction in Language Models (arxiv.org)
36
1
Sampling Decisions: Exact Path-Space Correction, Prior Cancellation and Local-Boltzmann Guidance (arxiv.org)
37
1
Looping Is Not Reliability: State-Bound Evidence and Typed Revision Contracts for Agentic Code Repair (arxiv.org)
38
1
Agentic Permissions Policy Algebra for Taint Confinement in LLM Agents (arxiv.org)
39
1
LEX-EC: A Lexical Evidence-Channel Audit Framework for Zero-Shot LLM Personality Classification in Black-Box Settings (arxiv.org)
40
1
BHARATI: Morphology-Aware Tokenizers for Classical Indian Languages with Subword Fertility Analysis (arxiv.org)
41
1
Loong: Synthesize Long Chain-of-Thoughts at Scale through Verifiers (arxiv.org)
42
1
ClinFusion: A Vision-Centric Multimodal LLM System for Holistic Medical Understanding (arxiv.org)
43
1
Reverso: Efficient Time Series Foundation Models for Zero-shot Forecasting (arxiv.org)
44
1
Efficient LLM-Generated Shuttling Compilers for Complex Trapped-Ion Architectures (arxiv.org)
45
1
Evaluating the Impact of Explainable AI on Trust in AI-Assisted Code Review (arxiv.org)
46
1
Training Language Models to Cooperate with Inference-Time Controllers (arxiv.org)
47
1
How Context Attribution Handles What the Model Already Knows (arxiv.org)
48
1
StageGuard: Physiologically Constrained Sleep Staging (arxiv.org)
49
1
Reinforcement Learning for Heterogeneous Sensor Selection in Maritime Surveillance (arxiv.org)
50
1
A Vocabulary for Multi-Agent Automated Research Systems (arxiv.org)