OpenAI представили SWE-Lancer
Сьогодні OpenAI представили новий бенчмарк SWE-Lancer, призначений для оцінювання можливостей передових мовних моделей (LLM) у виконанні реальних фріланс-завдань із програмування. Бенчмарк охоплює 1488 (гусари, мовчати) завдань із платформи Upwork, сумарною…












