Cognition представила FrontierCode, новый бенчмарк для оценки ИИ по качеству кода, с 150 задачами и оценкой качества исполнения.