AHD Agent: Agentic Reinforcement Learning for Automatic Heuristic Design
Explorar
Noticias de IA
29335 elementos — filtrados, clasificados y sin duplicados
Do LLMs Know Their Vulnerable Scenarios?
Long-Horizon AI Research for Grothendieck Constant: A Case Study in Human-AI Mathematical…
Cueless EEG imagined speech for subject identification: dataset and benchmarks
Unmasking Conversational Bias in AI Multiagent Systems
Unlearning at Scale: State-Exact Trace-Preserving Deletion in Billion-Parameter Language …
Gradual Code-Switching as Inference-Time Cross-Lingual Representational Alignment for LLMs
DiffGRM: Diffusion-based Generative Recommendation Model
SONIC: Supersizing Motion Tracking for Natural Humanoid Whole-Body Control
Automated Design Optimization via Strategic Search with Large Language Models
MOSAIC: Unveiling the Moral, Social and Individual Dimensions of Large Language Models
CangjieBench: Benchmarking LLMs on a Low-Resource General-Purpose Programming Language
Automatic Termination Strategy of Inelastic Neutron-scattering Measurement Using Bayesian…
IACDM: Interactive Adversarial Convergence Development Methodology -- A Structured Framew…
Cat-DPO: Category-Adaptive Safety Alignment
SAFE-SVD: Sensitivity-Aware Fidelity-Enforcing SVD for Physics Foundation Models
Fast and Memory-Efficient Wavelet Convolutions via I/O-Aware Reformulation
Trie Automata for Constrained Decoding over Large Finite Sets
Auditable agentic AI for evidence-grounded thyroid ultrasound diagnosis and reporting
SteerBench-Work: A Benchmark for Agent Steering at Action Boundaries
Lines and Ladders: A Context-Aware Multi-Agent Framework for Large-Scale Retail Price Tax…
Privacy-Preserving RAG by Concealing Sensitive Information from External LLMs
Beyond the Best Guess: Improving LLM Solution Coverage with Evolution Strategies
OGR-MARL: Option-Guided Residual Multi-Agent Reinforcement Learning for Heterogeneous USV…
Foundations of MT-PDCL: Measure-Theoretic Probabilistic Definite Clause Logic
From Local Mismatch to Global Impact: Optimizing Cache Reuse Policy for Efficient Diffusi…
VALG: An Agentic System for ML Theory Research
Explanatory Engagement Under Rare Anomalous Failure: Asymptotic Rarity in Model Behavior …
Behavioral Reprogramming of Open-Weights Models: Cognitive Plasticity and Alignment Bounds
SPADE: Speculative Decoding for Precise and Low Cost Distributed Edge Cloud Inference