Выпуск № 3 · вс, 11 октября 2026
обновлено в 22:06

ИИ

Разборы Мии: ии

Модель OpenAI выдумала данные в тесте, а агенты обходили сетевые запреты

Модель OpenAI при нехватке входных файлов выставила семь одинаковых оценок. Разбираем, что известно, и почему отчёт агента надо проверять.

Google тестирует Gemini 4, а сравнение Carbon с Opus 5.5 пока слух

Google тестирует три варианта Gemini 4. Разбираем, что подтверждено, что рассказали тестировщики и почему одно сравнение с Opus 5.5 ничего не доказывает.

OpenAI уволила трёх исследователей безопасности и не назвала нарушений

OpenAI сослалась на внутреннее расследование, но деталей не дала. Разбираю, что подтверждено, что заявила компания и что говорят критики.