Reference-Free Post-Training of Open Large Language Models for Multilingual Machine Trans…
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
Consolidator: Learning Persistent Routed Memory Across Context Boundaries
REOPD: Reliability-Adaptive Reward Extrapolation for On-Policy Distillation
TRACE Bench: Task-driven Roleplay Agentic Checklist Evaluation
How to Spend Your Oracle Budget: Practical Guidance for Protein Structure Prediction Mode…
LLMs in Process Diagram Engineering: From Optimal PFDs to Validated P&IDs
Social Meaning in Large Language Models: Structure, Magnitude, and Pragmatic Prompting
MOON: Multi-Objective OrthoNormalized Updates for Multitask Learning
Uncertainty as a Planning Signal: Multi-Turn Decision Making for Goal-Oriented Conversati…
DORA Explorer: Improving the Exploration Ability of LLMs Without Training
From Monolithic to Modular: Segment-level Automatic Prompt Optimization
Program Semantic Inequivalence Game with Large Language Models
Small Data Explainer -- The impact of small data methods in everyday life
Quantization-Aware Neuromorphic Architecture for Skin Lesion Classification on Resource-C…
GUIDE: Governed Unified Intelligence for Document-to-Artifact Generation in Enterprise Se…
Retry, Switch, or Abstain? Learning Strategy-Aware Tool-Use Policies via Controlled Error…
ExRole: From Team Trajectories to Executable Roles in Multi-Agent Language Models
ReXrank: A Public Leaderboard for AI-Powered Radiology Report Generation
HYDRA: Hyperbolic Dynamic Representation Architecture for Kolmogorov-Arnold Networks
Ethics Practices in AI Development: An Empirical Study Across Roles and Regions
HyperANFIS: Enhancing Rule Representation and Interpretability in Adaptive Neuro-Fuzzy Sy…
On the Definition of Intelligence
Co-constructing sociotechnical AI governance: participatory system mapping using algorith…
QV-PIC: Query-Aware Visual Position-Independent Caching for Efficient RAG Serving
AI4AI at Test-Time: Strong-to-Weak Capability Transfer via Harnesses
Who Thinks Best Depends on How Long You Let Them: Budget-Dependent Rankings in LLM Evalua…
Conformity Mitigations in Large Language Models Lie on a Single Resistance-Receptivity Fr…
RealisticTritonBench: A Benchmark for Triton-Kernel Generation in Real-World AI Frameworks
ENTLORE: A Graph-Grounded Benchmark for Latent Organizational Reasoning in Enterprise Que…
G0.5: One Autoregressive Stream for Robot Reasoning and Action