Загружаем каталог…
Загружаем каталог…
We introduce MLE-bench, a benchmark for measuring how well AI agents perform at machine learning engineering.
То, что RADAR обнаружил и классифицировал для этой возможности. Это опубликованный источником текст, а не подтверждение, что предложение ещё действует.
MLE-bench: Evaluating Machine Learning Agents on Machine Learning Engineering. We introduce MLE-bench, a benchmark for measuring how well AI agents perform at machine learning engineering.
Открыть источникКаталог показывает сохранённые возможности RADAR. Доступность хранилища не означает, что источники проверены или акции действуют.