HiSpec: Hierarchical Speculative Decoding for LLMs
Explorar
Noticias de IA
21270 elementos — filtrados, clasificados y sin duplicados
EconCausal: A Context-Aware Economic Reasoning Benchmark for Large Language Models
Evaluating Sample Utility for Efficient Data Selection by Mimicking Model Weights
Mechanistic Interpretability of Antibody Language Models Using SAEs
SEAL: Self-Evolving Agentic Learning for Conversational Question Answering over Knowledge…
Seeing vs. Believing: Evaluating the Language Bias of Open-Source MLLMs in Counter-Intuit…
Learning Decentralized LLM Collaboration with Multi-Agent Actor Critic
2-ASP(Q) programs with weak constraints: Complexity and efficient implementation
Drive-P2D: A Progressive Perception-to-Decision Benchmark for VLMs in Autonomous Driving
The AI Cognitive Trojan Horse: How Large Language Models May Bypass Human Epistemic Vigil…
Left-Right Symmetry Breaking in CLIP-style Vision-Language Models Trained on Synthetic Sp…
GraphDancer: Training LLMs to Explore and Reason over Graphs via Two-Stage Curriculum Pos…
Constructing Industrial-Scale Optimization Modeling Benchmark
Adapting Actively on the Fly: Relevance-Guided Online Meta-Learning with Latent Concepts …
Persona2Web: Benchmarking Personalized Web Agents for Contextual Reasoning with User Hist…
Natural Language Query to Configuration for Retrieval Agents
PaTAS: A Framework for Trust Propagation in Neural Networks Using Subjective Logic
GICDM: Mitigating Hubness for Reliable Distance-Based Generative Model Evaluation
Geometrically Constrained Outlier Synthesis
AI-Driven Contribution Evaluation and Conflict Resolution: A Framework & Design for Group…
Belief-Sim: Towards Belief-Driven Simulation of Demographic Misinformation Susceptibility
Stop Listening to Me! How Multi-turn Conversations Can Degrade LLM Reliability
FedTreeLoRA: Reconciling Statistical and Functional Heterogeneity in Federated LoRA Fine-…
Omanic: Towards Step-wise Evaluation of Multi-hop Reasoning in Large Language Models
APEX-Searcher: Refining Credit Assignment with Subgoaling for Agentic Retrieval-Augmented…
Detached Skip-Links and $R$-Probe: Decoupling Feature Aggregation from Gradient Propagati…
Strategic Persuasion with Trait-Conditioned Multi-Agent Systems for Iterative Legal Argum…
From PDF to RAG-Ready: Evaluating Document Conversion Frameworks for Domain-Specific Ques…
Understanding the Challenges in Iterative Generative Optimization with LLMs
SenBen: Sensitive Scene Graphs for Explainable Content Moderation