Jetson-PI: Towards Onboard Real-Time Robot Control via Foresight-Aligned Asynchronous Inf…
Explorar
Noticias de IA
22318 elementos — filtrados, clasificados y sin duplicados
NexForge: Scaling Agent Capabilities through Requirement-Driven Task Synthesis for LLMs
Beyond Success Rate: Cost-Aware Evaluation of Offensive and Defensive Security Agents
Memory-Driven Self-Disclosure and Relational Turning Points: A Longitudinal Multimodal St…
Digital Pantheon: Simulating and Auditing Coalition Formation with LLM Agents
ToolVerse: Unlocking Massive Environments and Long-Horizon Tasks for Agentic Reinforcemen…
EgoExoMoCap: Distributed Ego-Exo Human Motion Capture
DECODEM: Data Extraction from Corporate Organizational Documents via Enhanced Methods
RTL-Sequencer: Towards Scalable RTL Timing Prediction with the Sequence-based Paradigm
CAMMAR: Culture-Aware Matryoshka for Metaphorical Arabic Representations
Value Leakage: An LLM's Answers Are Silently Shaped by Its Own Values
LVSum: A Benchmark for Timestamp-Aware Long Video Summarization
RESOURCE2SKILL: Distilling Executable Agent Skills from Human-Created Multimodal Resources
RLearner-LLM: Balancing Logical Grounding and Fluency in Large Language Models via Hybrid…
Code-MUE: Measuring Code LLMs' Uncertainty through Execution-based Semantic Interaction G…
Cache-Aware Prompt Compression:A Two-Tier Cost Model for LLM API Caching
LLM-Driven AutoML for Cross-Lingual Handwritten OCR: Closed-Loop Neural Architecture Sear…
Design-Based Supervised Learning with Noisy Human Labels
AI Trading: Evaluating Large Language Models for Technical Market Analysis
Large Language Models as Unified Multimodal Learners for Clinical Prediction
Data-driven Video Codec with Implicit Neural Representations
Interaction-Aware Whole-Body Control for Compliant Object Transport
GraphDx: A Cost-Aware Knowledge-Enhanced Multi-Agent Framework for Sequential Diagnosis
When Perplexity Lies: Generation-Focused Distillation of Hybrid Sequence Models
T^2MLR: Transformer with Temporal Middle-Layer Recurrence
Alipay-PIBench: A Realistic Payment Integration Benchmark for Coding Agents
MaxSAT-Based Feedback for Guiding Vision-Language Models in Sudoku
UCOB: Learning to Utilize and Evolve Agentic Skills via Credit-Aware On-Policy Bidirectio…
Human-Aligned Procedural Level Generation Reinforcement Learning via Text-Level-Sketch Sh…
RAD: Retrieval High-quality Demonstrations to Enhance Decision-making