LsrIF: Enhancing Logic-Structured Instruction Following of Large Language Models
Explorar
Noticias de IA
30304 elementos — filtrados, clasificados y sin duplicados
SVSR: A Self-Verification and Self-Rectification Paradigm for Multimodal Reasoning
AutoSizer: Automatic Sizing of Analog and Mixed-Signal Circuits via Large Language Model …
Online Fair Division with Additional Information
SciHorizon-DataEVA: An Agentic System for AI-Readiness Evaluation of Heterogeneous Scient…
GEO-Bench: Benchmarking Ranking Manipulation in Generative Engine Optimization
Thinking Before Constraining: A Unified Decoding Framework for Large Language Models
Human-Guided Harm Recovery for Computer Use Agents
AttuneBench: A Conversation-Based Benchmark for LLM Emotional Intelligence
NOVA: Fundamental Limits of Knowledge Discovery Through AI
Jailbreaking and Mitigation of Vulnerabilities in Large Language Models
OmniMatBench: A Human-Calibrated Multimodal Reasoning Benchmark Across 19 Materials Scien…
Harnessing non-adversarial robustness in large language models
Are LLMs Socially Adaptive? Contrasting Belief Evolution in Large Language Models and Hum…
DynSess: Dynamic Session-Level Evaluation and Optimization Framework for Role-Playing Age…
Crafting Desirable Climate Trajectories with RL Explored Socio-Environmental Simulations
MATNet: Multi-Level Fusion Transformer-Based Model for Day-Ahead PV Generation Forecasting
SPEED-Bench: A Unified and Diverse Benchmark for Speculative Decoding
AgentDoG 1.5: A Lightweight and Scalable Alignment Framework for AI Agent Safety and Secu…
Finding DoRI: Discovery of Retained Images in Diffusion Models
MEMENTO: Leveraging Web as a Learning Signal for Low-Data Domains
EvoMD-LLM: Learning the Language of Species Evolution in Reactive Molecular Dynamics
LFQ: Logit-aware Final-block Quantization for Boosting the Generation Quality of Low-Bit …
HPO: Hysteretic Policy Optimization for Stable and Efficient Training under Sparse-Reward…
Unifying Temporal and Structural Credit Assignment in LLM-Based Multi-Agent Prompt Optimi…
Uncertainty-Aware Transfer Learning for Cross-Building Energy Forecasting: Toward Robust …
Teacher-Guided Policy Optimization for On-Policy Reasoning Distillation under Large Polic…
Weakly Supervised Detection and Temporal Localization of Whale Calls in Long-Duration Bio…
BEAT: Tokenizing and Generating Symbolic Music by Uniform Temporal Steps
MusTBENCH: Benchmarking and Advancing Temporal Grounding in Music LLMs