Explorar

Noticias de IA

30304 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
LsrIF: Enhancing Logic-Structured Instruction Following of Large Language Models
arXiv cs.AI Research & Papers
SVSR: A Self-Verification and Self-Rectification Paradigm for Multimodal Reasoning
arXiv cs.AI Research & Papers
AutoSizer: Automatic Sizing of Analog and Mixed-Signal Circuits via Large Language Model …
arXiv cs.AI Research & Papers
Online Fair Division with Additional Information
arXiv cs.AI Research & Papers
SciHorizon-DataEVA: An Agentic System for AI-Readiness Evaluation of Heterogeneous Scient…
arXiv cs.AI Research & Papers
GEO-Bench: Benchmarking Ranking Manipulation in Generative Engine Optimization
arXiv cs.AI Research & Papers
Thinking Before Constraining: A Unified Decoding Framework for Large Language Models
arXiv cs.AI Research & Papers
Human-Guided Harm Recovery for Computer Use Agents
arXiv cs.AI Research & Papers
AttuneBench: A Conversation-Based Benchmark for LLM Emotional Intelligence
arXiv cs.AI Research & Papers
NOVA: Fundamental Limits of Knowledge Discovery Through AI
arXiv cs.AI Security & Safety
Jailbreaking and Mitigation of Vulnerabilities in Large Language Models
arXiv cs.AI Research & Papers
OmniMatBench: A Human-Calibrated Multimodal Reasoning Benchmark Across 19 Materials Scien…
arXiv cs.AI Research & Papers
Harnessing non-adversarial robustness in large language models
arXiv cs.AI Research & Papers
Are LLMs Socially Adaptive? Contrasting Belief Evolution in Large Language Models and Hum…
arXiv cs.AI Research & Papers
DynSess: Dynamic Session-Level Evaluation and Optimization Framework for Role-Playing Age…
arXiv cs.AI Research & Papers
Crafting Desirable Climate Trajectories with RL Explored Socio-Environmental Simulations
arXiv cs.AI Research & Papers
MATNet: Multi-Level Fusion Transformer-Based Model for Day-Ahead PV Generation Forecasting
arXiv cs.AI Research & Papers
SPEED-Bench: A Unified and Diverse Benchmark for Speculative Decoding
arXiv cs.AI Research & Papers
AgentDoG 1.5: A Lightweight and Scalable Alignment Framework for AI Agent Safety and Secu…
arXiv cs.AI Research & Papers
Finding DoRI: Discovery of Retained Images in Diffusion Models
arXiv cs.AI Research & Papers
MEMENTO: Leveraging Web as a Learning Signal for Low-Data Domains
arXiv cs.AI Research & Papers
EvoMD-LLM: Learning the Language of Species Evolution in Reactive Molecular Dynamics
arXiv cs.AI Research & Papers
LFQ: Logit-aware Final-block Quantization for Boosting the Generation Quality of Low-Bit …
arXiv cs.AI Research & Papers
HPO: Hysteretic Policy Optimization for Stable and Efficient Training under Sparse-Reward…
arXiv cs.AI Research & Papers
Unifying Temporal and Structural Credit Assignment in LLM-Based Multi-Agent Prompt Optimi…
arXiv cs.AI Research & Papers
Uncertainty-Aware Transfer Learning for Cross-Building Energy Forecasting: Toward Robust …
arXiv cs.AI Research & Papers
Teacher-Guided Policy Optimization for On-Policy Reasoning Distillation under Large Polic…
arXiv cs.AI Research & Papers
Weakly Supervised Detection and Temporal Localization of Whale Calls in Long-Duration Bio…
arXiv cs.AI Research & Papers
BEAT: Tokenizing and Generating Symbolic Music by Uniform Temporal Steps
arXiv cs.AI Research & Papers
MusTBENCH: Benchmarking and Advancing Temporal Grounding in Music LLMs