Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

Hugging Face Blog Research & Papers
Open Preference Dataset for Text-to-Image Generation by the 🤗 Community
Hugging Face Blog Research & Papers
How good are LLMs at fixing their mistakes? A chatbot arena experiment with Keras and TPUs
Hugging Face Blog Research & Papers
Rethinking LLM Evaluation with 3C3H: AraGen Benchmark and Leaderboard
Hugging Face Blog Research & Papers
Investing in Performance: Fine-tune small models with LLM insights - a CFM case study
Hugging Face Blog Research & Papers
You could have designed state of the art positional encoding
Hugging Face Blog Research & Papers
Faster Text Generation with Self-Speculative Decoding
Hugging Face Blog Research & Papers
Letting Large Models Debate: The First Multilingual LLM Debate Competition
Hugging Face Blog Research & Papers
Judge Arena: Benchmarking LLMs as Evaluators
AINews / smol.ai Research & Papers
Common Corpus: 2T Open Tokens with Provenance
AINews / smol.ai Research & Papers
BitNet was a lie?
AINews / smol.ai Research & Papers
FrontierMath: A Benchmark for Evaluating Advanced Mathematical Reasoning in AI
AINews / smol.ai Research & Papers
Creating a LLM-as-a-Judge
OpenAI News Research & Papers
Introducing SimpleQA
Hugging Face Blog Research & Papers
Universal Assisted Generation: Faster Decoding with Any Assistant Model
Hugging Face Blog Research & Papers
Expert Support case study: Bolstering a RAG app with LLM-as-a-Judge
AINews / smol.ai Research & Papers
s{imple|table|calable} Consistency Models
Hugging Face Blog Research & Papers
A Deepdive into Aya Expanse: Advancing the Frontier of Multilinguality
OpenAI News Research & Papers
Simplifying, stabilizing, and scaling continuous-time consistency models
Hugging Face Blog Research & Papers
CinePile 2.0 - making stronger datasets with adversarial refinement
AINews / smol.ai Research & Papers
DocETL: Agentic Query Rewriting and Evaluation for Complex Document Processing
OpenAI News Research & Papers
Evaluating fairness in ChatGPT
OpenAI News Research & Papers
MLE-bench: Evaluating Machine Learning Agents on Machine Learning Engineering
Hugging Face Blog Research & Papers
Faster Assisted Generation with Dynamic Speculation
Hugging Face Blog Research & Papers
Introducing the Open FinLLM Leaderboard
Hugging Face Blog Research & Papers
🇨🇿 BenCzechMark - Can your LLM Understand Czech?
AINews / smol.ai Research & Papers
not much happened today
Hugging Face Blog Research & Papers
Fine-tuning LLMs to 1.58bit: extreme quantization made easy
OpenAI News Research & Papers
Learning to reason with LLMs
OpenAI News Research & Papers
Economics and reasoning with OpenAI o1
OpenAI News Research & Papers
Decoding genetics with OpenAI o1