ChainCaps: Composition-Safe Tool-Using Agents via Monotonic Capability Attenuation
Explorar
Noticias de IA
30239 elementos — filtrados, clasificados y sin duplicados
Advancing Creative Physical Intelligence in Large Multimodal Models
JetViT: Efficient High-Resolution Vision Transformer with Post-Training Attention Search
Bilevel Optimization over Saddle Points of Zero-Sum Markov Games
StepOPSD: Step-Aware Online Preference Distillation for Agent Reinforcement Learning
Scaling, Benchmarking, and Reasoning of Vision-Language Agents for Mobile GUI Navigation
Reliable Extraction of Clinical Follow-Up Instructions: A Hybrid Neural-Symbolic Pipeline
Traceable Knowledge Graph Reasoning Enables LLM-Assisted Decision Support for Industrial …
Symmetry-Compatible Principle for Optimizer Design: Embeddings, LM Heads, SwiGLU MLPs, an…
Erased but Exploitable: Black-box Embedding-Aware Prompting Against Unlearned Text-to-Ima…
BioFormer: Rethinking Cross-Subject Generalization via Spectral Structural Alignment in B…
E$^3$C: Video Generation with 3D Environmental Memory and Ego-Exo Human Pose Control
Curriculum Learning for Safety Alignment
CSV-ViT: A Vision Transformer with the Variable-sized Cortical Supervertices for Detectio…
Generating Robust Portfolios of Optimization Models using Large Language Models
On the Detection of Commutative Factors in Factor Graphs: Necessary and Sufficient Condit…
CyberEvolver: Structured Self-Evolution for Cybersecurity Agents On the Fly
QUACK: Questioning, Understanding, and Auditing Communicated Knowledge in Multimodal Soci…
Tracing Computation Density in LLMs
GraphIP-Bench: How Hard Is It to Steal a Graph Neural Network, and Can We Stop It?
Tournament-GRPO: Group-Wise Tournament Rewards for Reinforcement Learning in Open-Ended L…
Strategies for Guiding LLMs to Use Software Design Patterns: A Case of Singleton
Negligible in Size, Significant in Effect: On Scale Vectors in Large Language Models
The Kalman Evolve: Closing the Gap in Kalman Filtering via Interpretable Algorithm Discov…
HTMLCure: Turning Browser Experience into State Guided Repair for Interactive HTML
SeDT: Sentence-Transformer Decision-Transformer Conditioning for Multi-Turn Conversation …
Towards Generalization-Oriented Models for Vehicle Routing Problems with Mixture-of-Exper…
Cordon-MAS: Defending RAG against Knowledge Poisoning via Information-Flow Control
L2Rec: Towards Dual-View Understanding of LLMs for Personalized Recommendation
Rotation-Invariant Spherical Watermarking via Third-Order SO(3) Representation Coupling