DMF: A Deterministic Memory Framework for Conversational AI Agents
Explorar
Noticias de IA
29349 elementos — filtrados, clasificados y sin duplicados
Rethinking the Role of Tensor Decompositions in Post-Training LLM Compression
Inference Cost Attacks for Retrieval-Augmented Large Language Models
Position: Prioritize Identifying Structure, Not Complex Models, for Scientific Discovery
KnapSpec: Self-Speculative Decoding via Adaptive Layer Selection as a Knapsack Problem
MultiTurnPSB: Evaluating Multi-Turn Jailbreak Attacks an dClassifier-Based Defenses for M…
OpenAgenet/OAN: Technical Architecture for Trust-Governed Agent Identity and Discovery
Oscillatory State-Space Models as Inductive Biases for Physics-Informed Neural PDE Solvers
CARVE: Certified Affordable Repair of Vetoed Maneuvers via Envelopes for Interactive Driv…
D-Judge: Disrupting Multi-Turn Jailbreaks using Semantics-Preserving Output Rewriting
DeskCraft: Benchmarking Desktop Agents on Professional Workflows and Human-in-the-Loop Co…
Hedge-Bench: Benchmarking Agents on Hard, Realistic Tasks Pertaining to Financial Reasoni…
Sparse-View Lung Nodule Volumetry from Digitally Reconstructed Radiographs via AReT: Anat…
TimeOmni-VL: Unified Models for Time Series Understanding and Generation
Whom to Query for What: Adaptive Group Elicitation via Multi-Turn LLM Interactions
AI Model Extraction Attacks: Bypassing Single-Client Assumptions in Defenses
Local Guidance, Global Impact: Gaussian-Reshaped Trust Region Unlocks Behavior Transitions
SegTune: Structured and Fine-Grained Control for Song Generation
WRIT: Write-Read Intensive Trajectory Synthesis for Multi-Turn User-Facing Agents
The Ringelmann Effect in Multi-Agent LLM Systems: A Scaling Law for Effective Team Size
Whose Name Comes Up? II: Benchmarking and Intervention-Based Auditing of LLM-Based Schola…
Think-Before-Speak: From Internal Evaluation to Public Expression in Multi-Agent Social S…
Phantom Transfer: Data Poisoning can Survive Data-Level Defences
AI Rater Discrimination Depends on Scoring Protocol in Complex Clinical Decision-Making
$\mathbb{R}^{2k}$ is Theoretically Large Enough for Embedding-based Top-$k$ Retrieval
Distill-then-Replace: Efficient Task-Specific Hybrid Attention Model Construction
SkillDAG: Self-Evolving Typed Skill Graphs for LLM Skill Selection at Scale
A Training-Free Mixture-of-Agents Framework for Multi-Document Summarization using LLMs a…
Bridging Auxiliary Constraints to Resolve Instruction Following in Large Reasoning Models
Target Updates May Stabilize Linear Q-Learning: Periodic and Soft Dynamics