ZhuLong: Execution-Grounded LLM Agent for EDA Scripting with Offline API Self-Exploration
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
Agentic Harnesses: LLM-Driven Verification Layers for Robot Autonomy
SR-OPSD: Self-Referenced On-Policy Self-Distillation
REIN: Bridging the Gap between Reasoning and Reliability via Reflection and Abstention Al…
Physical AI Governance: From Theory to Practice Across Life Cycle
Bridging the Evaluation Gap: Standardized Benchmarks for Multi-Objective Search
AIVV: Neuro-Symbolic LLM Agent-Integrated Verification and Validation for Trustworthy Aut…
HyperFake: Hyperspectral Reconstruction and Attention-Guided Analysis for Advanced Deepfa…
EgoBrain: Synergizing Minds and Eyes For Human Action Understanding
The Cost of Language: Centroid Erasure Exposes and Exploits Modal Competition in Multimod…
Decided Upstream, Written Late: Locating and Pricing the Cross-Lingual Refusal Circuit of…
Explore, Map, Remember, Decide: Are Embodied VLMs Ready for Safety-Critical Scenarios?
Stochastic Subgradient Methods with Guaranteed Global Stability in Nonsmooth Nonconvex Op…
KGCache: Amortized Subgraph Retrieval for KG Reasoning with LLMs
Critic-Free Deep Reinforcement Learning for Maritime Coverage Path Planning on Irregular …
CyberAGENTS: Structured Autonomy for Agentic Gamified Learning in Cybersecurity
Contamination Means Overestimation? A Fine-Grained Empirical Study in Code Intelligence
ATLASFusion: Aggregation Tracking with Location-Aware Sparse Fusion for Robust Spatio-Tem…
Rethinking KV Cache Eviction via a Unified Information-Theoretic Objective
In-Situ Behavioral Evaluation for LLM Fairness, Not Standardized-Test Scores
Your Prompt Is Not the Only Prompt: How Much Do LLMs Weight Structured-Output Schema Desc…
Mitigating Over-Personalization in LLMs via Structured Memory
Query-Only Backdoor Attacks on Self-Evolving Skills via Trajectory Poisoning
LLMVisor: A Real-Time Latency Attribution Model for Multi-Tenant LLM Serving
Not Worth Another Token: Marginal Value Estimation for Efficient Deep Research Agents
Estimating Uncertainty in Galaxy Morphology Classification
What Keeps Agent Skills from Being Reusable? Evidence from 138K SKILL.md Files
Yesterday's Shield, Today's Spear: A Self-Evolving Safety Guardrail in Production
SkillReason: Reasoning-Enhanced Agent Skill Retrieval for Implicit User Requests
Branch2Skill: Efficient Skill Evolution Through Reasoning Trees