Measuring and Mitigating Bias in Code Generated by Large Language Models
Explorar
Noticias de IA
21861 elementos — filtrados, clasificados y sin duplicados
Business Utility of Large Language Models as Exploratory Data Analysis Agents
From Human Videos to Robot Manipulation: A Survey on Scalable Vision-Language-Action Lear…
Beyond Tool Adoption: A Practical Five-Stage Developmental Continuum for AI Literacy in H…
Beyond Categories of Caste: Examining Caste Bias and Morality in Text-to-Image AI Models
Improving Hospital Process Management through Process Mining: A Case Study on COVID-19 Cl…
A Multi-Domain Red Teaming Framework for Safety, Robustness, and Fairness Evaluation of M…
LLMs for Cardiovascular Risk Prediction from Structured Clinical Data
Make Mechanistic Interpretability Auditable: A Call to Develop Guidelines via Continuous …
SENSE: Semantic Embedding Navigation with Soft-gated Evaluation for Retrieval-based Specu…
lmfaoooo at SemEval-2026 Task 1: Humor Is an Audience. Preference Modeling for Constraine…
SortingHat: Redefining Operating Systems Education with a Tailored Digital Teaching Assis…
AEyeDE: An Attention-Based Attribution Framework for AI-Generated Text Detection
BenHalluEval: A Multi-Task Hallucination Evaluation Framework for Large Language Models o…
RuleEdit: Failure-Guided Human-AI Model Editing with Prospective Impact Preview
A phenomenon of AI-conformity: how algorithms change human moral decision-making
SafeSteer: Localized On-Policy Distillation for Efficient Safety Alignment
Tracking the Behavioral Trajectories of Adapting Agents
ClinEnv: An Interactive Multi-Stage Long Horizon EHR Environment for Agents
A Novel Data Augmentation Strategy for Robust Deep Learning Classification of Biomedical …
MCP-Persona: Benchmarking LLM Agents on Real-World Personal Applications via Environment …
Unsupervised Cognition
HLL: Can Agents Cross Humanity's Last Line of Verification?
LLM-Evolved Pattern Generators for Optimal Classical Planning
A Mathematical Conflict Framework for Contextual Data Modulation
Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses
MOC: Multi-Order Communication in LLM-based Multi-Agent Systems
SIRI: Self-Internalizing Reinforcement Learning with Intrinsic Skills for LLM Agent Train…
VLM4VLA: Revisiting Vision-Language-Models in Vision-Language-Action Models
Safe-FedLLM: Delving into the Safety of Federated Large Language Models