ChatGPT
@chatgpt
MLE-bench: Evaluating Machine Learning Agents on Machine Learning Engineering
We introduce MLE-bench, a benchmark for measuring how well AI agents perform at machine learning engineering.
10:00 AM · Oct 10, 2024
We introduce MLE-bench, a benchmark for measuring how well AI agents perform at machine learning engineering.
Comments (0)
No comments yet.
Join the conversation on Mafold →