HarmProfile: Characterizing Harmful Distributions in Frontier LLMs
Explorar
Noticias de IA
37834 elementos — filtrados, clasificados y sin duplicados
Do Personalized Skills Help Coding Agents? An Empirical Study of Developer Interaction Hi…
JarvisBench: Always-on Intelligence Between Humans and Agents
The Open-Strategy Dictator Game: Cooperation Under Mutual Transparency
Position: AI Governance Needs ISO-like Interoperability Protocols, Not Just Laws
PaSTel: Anchoring Histology in Spatial Transcriptomics via Multi-Scale Hierarchical Bio-P…
CAPO: Constraint-Aware Prompt Optimization for LLM Agents
ARENA: Automated Red-Teaming for Large Audio Language Models
Looks Can be Deceiving: Annotator and Reviewer Performance Across Imagery Sources in Crow…
Position: AI Agents in Scientific Teams Should Be Studied as Human-Agent Systems
Equilibrium Forcing: Adaptive Video Generation Without Noise Conditioning
Scaling Manual-Grounded Appliance Manipulation with Data Synthesis and Unified Planning
Beyond Visual CoT: Internalized Visual Thinking for Proactive Video Reasoning
The Authority Resolution Framework: A Five-Domain Ontology for Governing Who and What Dec…
Position: Evaluations of AI Moral Reasoning Still Miss Half of the Picture
KV-Rescue: Recovering Reasoning Language Model KV Eviction Loss via Stepwise Interleaving
Global AI Regulations for FAIR and Ethics in High-Risk Use Cases: A Comparative Review
Domain Agnostic Text Redaction from Natural Language Rules using Instruction Tuning
From Doyle to AGM: A Survey and an Implementation Roadmap for Belief Change
Beyond Correctness: Toward Automated Novelty Verification with Lean 4
RISE: Roadside Infrastructure Sequence Understanding across 3D Tracking and Structured Vi…
PertMind: Eliciting Emergent Biological Reasoning in LLM via Reinforcement Learning on Ce…
GaussMemory: Task-Driven 3D Gaussian Scene Memory for Long-Horizon Robotic Manipulation
Securing AI-Generated Code: A Just-in-Time Vulnerability Detection and Remediation Pipeli…
Evaluating Agentic Code Repair Capabilities in Distributed Systems
An Agentic Framework Using Rules and LLMs for Embedding and Annotating Descriptive Docume…
Identifying Harm in Personalized, Generative AI Systems Requires User-Centered Auditing a…
Tail-Aware Top-$k$ On-Policy Distillation
Agent Inheritance Protocol: Speculating on Feralized Agents After Principals Die
An Evaluation Framework for National AI Regulation