PReMISE: Policy Rubrics as Measurement Specifications for LLM Judges
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
What changes after deployment? A survey on On-device Learning in TinyML
Reinterpreting Safety Thresholds as Neuron Spiking Thresholds
Benchmarking and Enhancing Text-to-Image Models for Generating Visual Representations in …
Automatically Attacking Software Reverse Engineering AI Agents
Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration
MindVoice: Reconstructing Intelligible Speech from Non-invasive Neural Signals with Pretr…
Emergent Languages in Populations of Language Model Agents: From Token Efficiency to Over…
Trust-Region Behavior Blending for On-Policy Distillation
ClimAgent: LLM as Agents for Autonomous Open-ended Climate Science Analysis
Language Models Learn Constructional Semantics, Not To Mention Syntax: Investigating LM U…
Developing a Culturally Grounded, AI-Augmented UX Research Point of View (POV): An Exempl…
TRINE: A Token-Aware, Runtime-Adaptive FPGA Inference Engine for Multimodal AI
SpatialAct: Probing Spatial Reasoning-to-Action Capabilities of VLM Agents in 3D Scenes
How Early Adopters Used Generative AI Worldwide: Variation by Country Income and Language
To Use AI as Dice of Possibilities with Timing Computation
On the Robustness of Multilingual Text Embedding Rankings Across Learning Tasks, Language…
FOCUS: Forcing In-Context Object Localization through Visual Support Constraints and Poli…
Extending the UXR Point of View Pyramid: A Generative AI-Augmented Methodology for Human-…
Enhancing Regime Shift Detection Using Unstructured Data: A Study on the Treasury Market
LLM-FACETS: A Privacy-Preserving Framework for Evaluating LLM Transparency and Accountabi…
UXR PoV for Neuroinclusive Emotion Regulation
Not All Synthetic Data Is Yours to Learn From
TARIC: Memory-Augmented Traversability-Aware Outdoor VLN under Interrupted Semantic Cues
Counterfactual Trace Auditing of LLM Agent Skills
MedCoG: Maximizing LLM Inference Density in Medical Reasoning via Meta-Cognitive Regulati…
Redefining Instance Matching: A Unified Framework for Part-Aware Matching in Panoptic Seg…
A Pilot Study on Curator-Guided Multilingual Art Description for Blind and Low-Vision Aud…
DRIFT: Joint Channel Estimation and Prediction Towards Pilotless 6G Non-Terrestrial Netwo…
When are LLMs Sufficient Policy Optimizers for Sequential RL Tasks?