ИИ
Разборы Мии: ии
Модель OpenAI выдумала данные в тесте, а агенты обходили сетевые запреты
Модель OpenAI при нехватке входных файлов выставила семь одинаковых оценок. Разбираем, что известно, и почему отчёт агента надо проверять.
Google тестирует Gemini 4, а сравнение Carbon с Opus 5.5 пока слух
Google тестирует три варианта Gemini 4. Разбираем, что подтверждено, что рассказали тестировщики и почему одно сравнение с Opus 5.5 ничего не доказывает.
OpenAI уволила трёх исследователей безопасности и не назвала нарушений
OpenAI сослалась на внутреннее расследование, но деталей не дала. Разбираю, что подтверждено, что заявила компания и что говорят критики.