Stageboost: Recommending Signals Based on Counterfactual Estimation
Explorar
Noticias de IA
37834 elementos — filtrados, clasificados y sin duplicados
Making Clinical Language Models Auditable: Concept-Guided Fine-Tuning for Robust Predicti…
Agent Mesh: Reliability Primitives for Non-Idempotent Agent Delegation - Identity Adequac…
Successive Capacity Growth: Task-Complexity-Driven Width and Depth Expansion for Vision T…
Benchmarking AI Agents for Hardware Design Automation via MCP Tool Calling
Beyond Execution: Auditing Experimental Fidelity in LLM-Driven Scientific Research
AffectOmni: RL-Verifiable People-Centric Grounded Affective Reasoning for Social and Art-…
HybridProver: Augmenting Theorem Proving with LLM-Driven Proof Synthesis and Refinement
Invocation-Level Reliability of Tool-Using Agents
Same Model, Different Harness: Different Coding-Agent Results
Predicting Consequences and Reinforcing Navigation Policies with Latent World Models
AesCanvas: A Large-Scale Dataset and Benchmark for Aesthetic Critique and Contextual Suit…
Persona-Execution Separation: An Architecture Pattern for Evolving LLM Agents under Execu…
Refusal Is Not Robustness: Auditing Confident Fabrication in Large Language Models on a P…
Is Your Neighborhood Safe? Place-based Stigma in Large Language Models' Urban Safety Judg…
A Task-Centric Ontology and Deterministic Domain Rules as a Verifiable Core for AI-Assist…
A Safety-Gated Multimodal AI Backend for Mental-Health Support: Hierarchical State Repres…
SAREF-based Ontology for Distributed AI Workflows across the Edge-Fog-Cloud Continuum
Explainable Artificial Intelligence for Customer Churn Prediction in Telecommunications: …
EEG-to-Report: An Annotation and Feature-Text Framework for Training Language Models on C…
Methodological and Conceptual Framework for 5D Multi-Table Analysis: A Unified Approach f…
Selection Bias Correction in Retail Intelligence
Why did My Robot Just Change Personality? Prompting Guidelines for a Grounded Robot Perso…
The Artificial Experimentalist: Discovery and Control of Self-Organizing Phenomena with A…
TutorTrace: A Dataset and Taxonomy for Classifying Learner Behavioral States during AI-As…
Large Models for Battery Prognostics and Health Management: A Review and Future Roadmap
PICasso: An AI-Enabled Design Framework for Autonomous Optimization of Silicon Photonic D…
Multi2AV-Safety: Benchmarking Safety in Multimodal-to-Audio-Video Generation
Can You Say This for Me? Speaking Up by Proxy in Co-Located Discussion
CIFQA: A Deterministic Tool-Grounded Multi-Agent LLM Framework for Financial Query Answer…