AI News

⚡ 13 minutes ago
1
1
Metamorphic Testing for Clinical ML Models: A Framework Proposal and Pilot Study (arxiv.org)
2
1
Uncertainty Modeling for Multi-Objective RTA Interception with Distillation Acceleration (arxiv.org)
3
1
Infinite-Precision Autoregressive Modeling for Vector Graphics and Layouts (arxiv.org)
4
1
NeurGO: Learning to Generate Elite Candidates for Meta-Black-Box Expensive Optimization (arxiv.org)
5
1
Characterizing Arbitrary Lindbladian Dynamics with a Few Pauli Measurements (arxiv.org)
6
1
Weighted Low-Rank Matrix Approximation: Acceleration and Applications (arxiv.org)
7
1
The Illusion of Secure LLM Code: Closing the Security Gap via Iterative Reprompting (arxiv.org)
8
1
BHARATI: Morphology-Aware Tokenizers for Classical Indian Languages with Subword Fertility Analysis (arxiv.org)
9
1
MixQuant: Adaptive Mixed-Precision Quantization for Large Language Models (arxiv.org)
10
1
Through the Bottleneck: How Multi-head Latent Attention Separates Content from Position in Language Models (arxiv.org)
11
1
IKS-Instruct: A 24,000-Example Multilingual Dataset for Teaching Language Models Indian Knowledge Systems (arxiv.org)
12
1
SpecAHD: Localize to Specialize for Automated Heuristic Design in Large-Scale Routing Problems (arxiv.org)
13
1
cMoLLM at Scale: Horizontal Scaling Laws for Mixture-of-LLMs (arxiv.org)
14
1
CALMRec: Causally Aligned Language Memory for Long-Horizon Recommendation (arxiv.org)
15
1
Co-Learning for Missing Arbitrary Modalities in Multi-modal Classification (arxiv.org)
16
1
Quantum Safe-Set Bayesian Optimization for Quality Improvement in Fuselage Assembly (arxiv.org)
17
1
Multi-Agent Privacy Game in Federated Learning: A Unified Mean-Field View (arxiv.org)
18
1
Efficiency Matters in Autonomous Research (arxiv.org)
19
1
Reason-Mediated Behavioral Models for Auditing LLM Social Simulators (arxiv.org)
20
1
Bit-Accurate FPGA Evaluation of Learned Feature Gating in a Fixed-Point Fourier-Feature Automatic Modulation Classifier (arxiv.org)
21
1
PhononBench-MP40: a spectrum-resolved benchmark dataset for phonon stability (arxiv.org)
22
1
Online Fair Division with Budget Constraints (arxiv.org)
23
1
Sparse Autoencoders Encode Both Concepts and Functions: The Downstream Geometry of Feature Effects (arxiv.org)
24
1
Verification-Notebook Learning for Source-Aware Multimodal Misinformation Detection (arxiv.org)
25
1
Multimodal Semantic-Probabilistic Objectness for Open World Object Detection (arxiv.org)
26
1
Queryable Self-Organizing Maps: A Database Abstraction for Topology-Driven Data Exploration (arxiv.org)
27
1
Multi-Objective Structured Pruning of LLMs for Latency and Model Size Optimization (arxiv.org)
28
1
FusionML: Prefill, Not Decode - Mechanism and Boundaries of CPU+GPU Co-Execution on Unified-Memory Apple Silicon (arxiv.org)
29
1
Neptuna: A Comprehensive Machine Learning Framework for Benchmarking Complex Multiphase Flows (arxiv.org)
30
1
CORVUS: Context Optimization and Reduction Via Underlying Synchronization for LLM Coding Agents (arxiv.org)
31
1
Practical advantage beyond the quadratic speedup limit with fully-quantum walks (arxiv.org)
32
1
VecTree-RAG: An Agentic Retrieval-Augmented Generation Framework Combining Vector and Tree Retrieval for Efficiency and Accuracy (arxiv.org)
33
1
Efficient LLM-Generated Shuttling Compilers for Complex Trapped-Ion Architectures (arxiv.org)
34
1
Subject-Level Heterogeneity in EEG Motor Imagery Decoding: A Large-Scale Benchmark and Portfolio-Based Reduction of the Search Space (arxiv.org)
35
1
E-Bench: Benchmarking Multi-Step Tool-Use Agents in Real-World Product Scenarios (arxiv.org)
36
1
MMOE: Modernizing Diffusion Transformers with Efficient Expert Design (arxiv.org)
37
1
Benchmarking LLMs for Verilog Design Flows (arxiv.org)
38
1
Evaluating RAG for French immigration law: a benchmark and baseline study (arxiv.org)
39
1
ObsDriveBench: Benchmarking Multimodal Understanding under Adverse Weather with Observability Awareness (arxiv.org)
40
1
Separating Capability from Permission: A Governance Framework for Agentic AI Autonomy Levels (arxiv.org)
41
1
Can an Actor-Critic Optimization Framework Improve Analog Design? (arxiv.org)
42
1
When Can You Correct Distribution Drift in Temporal Graph Generation? A Sharpening--Drift Tension and an Impossibility for Observation-Based Correction (arxiv.org)
43
1
Discrepancy-Rounded Fair Bandits with Static and Time-Varying Exposure Floors (arxiv.org)
44
1
ARdena: Scenario-driven control of real-time LLM agents (arxiv.org)
45
1
Verbalized Particle Posterior: Bayesian Inference over Natural Language Hypotheses (arxiv.org)
46
1
MioFFAn: an Annotation Software for Formula Formalization with LLM Automation Capabilities (arxiv.org)
47
1
Beyond Error-vs-Discard Characteristic: Toward Stable and Reliable Evaluation for Face Image Quality Assessment (arxiv.org)
48
1
How LLM Task-Adaptation Reshapes Alignment: A Multi-dimensional Study of Behavioral and Representational Drift (arxiv.org)
49
1
Delegation Intelligence in Deep Search: A Controllable Framework for Disentangled Capability Diagnosis (arxiv.org)
50
1
Hallucination Rates in Language Generation (arxiv.org)