Модели
Новые модели ИИ, их возможности и ограничения: релизы, сравнения, результаты тестов и изменения в условиях доступа.
Google выпустила EmbeddingGemma 2: модель для локального поиска по разным типам данных
EmbeddingGemma 2 преобразует текст, изображения, видео, аудио и код в векторы. Google заявляет, что модель с 740 млн параметров показывает результаты на мультимодальных тестах на уровне конкурентов вдвое крупнее.
2 мин чтенияTwelveLabs выпустила Pegasus 1.6 для разметки видео от первого лица
Модель сегментирует записи действий и формирует описания для подготовки данных обучения роботов. Однако преобразовать эти наблюдения в команды управления роботом разработчикам предстоит самостоятельно.
4 мин чтенияПо данным The Verge, с 9 октября бесплатный Gemini оставит только Flash Lite
Бесплатным пользователям Gemini станет доступна только модель Flash Lite. Подписка Google AI Plus за $4,99 в месяц вскоре также перестанет включать Gemini Pro.
1 мин чтенияReflection выпустила открытую модель Beam для программирования и ИИ-агентов
Модель с 501 млрд параметров активирует 23 млрд на каждый токен. Reflection утверждает, что на некоторых задачах Beam сопоставима с конкурентами при меньших вычислительных затратах; веса и документация должны появиться позднее.
3 мин чтенияAleph Alpha выпустила модель Kolibri с открытыми весами
Немецкая компания Aleph Alpha представила Kolibri — немецко-английскую языковую модель с 78 млрд параметров.
1 мин чтенияBlack Forest Labs выпустила Flux 3 Image для точечного редактирования изображений
Black Forest Labs представила Flux 3 Image — модель для работы с изображениями из семейства Flux 3.
1 мин чтенияGemini 4 Argon догнала лидеров в ряде тестов, но расходует больше токенов
В рейтинге Artificial Analysis Gemini 4 Argon получила 53 балла и сравнялась с GPT-6 Astra и Claude Fable 5.1, но уступила Opus 5.5 и Sonnet 5.5. Вводный тариф ниже конкурентов, однако модель в среднем использовала больше выходных токенов на задачу.
2 мин чтенияGoogle открыла Gemini 4 Argon сначала только для избранных специалистов по киберзащите
Компания ограничивает ранний доступ к новой frontier-модели группой «доверенных киберзащитников» и говорит о проверке мер безопасности перед расширением запуска.
1 мин чтенияОткрытая GLM-5.3 почти сравнялась с Claude Mythos в создании атак
Модель GLM-5.3 китайской компании Zhipu, которую можно скачать, почти не уступает закрытой Claude Mythos Preview в создании работающих атак на уязвимости — утверждает Anthropic.
2 мин чтенияOpenAI остановила выпуск GPT-6.1 Astra из-за опасного поведения
Модель планировали выпустить в ChatGPT и Codex в октябре, но компания отменила запуск после внутренних проверок.
2 мин чтенияClaude Sonnet 5.5 выполняет задачи до 30% дешевле
Anthropic выпустила Claude Sonnet 5.5: по заявлению компании, модель генерирует ответы более чем на 30% быстрее предыдущей версии и может снизить стоимость выполнения задачи максимум на 30%.
1 мин чтенияNvidia выпустила открытую модель для распознавания до восьми собеседников
Nemotron 3 Diarization размечает говорящих в записи и живом аудио, включая одновременную речь. Модель насчитывает около 100 млн параметров; шум и большое число участников ухудшают точность.
1 мин чтенияGoogle добавила в Gemini 3.8 Live говорящего аватара
Google представила Live Avatar — анимированного персонажа, который в реальном времени отвечает собеседнику: двигает губами в такт речи и меняет выражение лица.
2 мин чтенияGemini 4 могут выпустить значительно раньше конца года
Gemini 4 уже находится на этапе доработки, а Google рассчитывает выпустить модель «значительно раньше» конца года.
2 мин чтенияГолосовой режим ChatGPT получил доступ к почте, календарю и Slack
Голосовой режим ChatGPT теперь работает на моделях OpenAI GPT-6 Astra, Sol и Luna и впервые получил доступ к почте, календарю и Slack.
2 мин чтенияGoogle представила две TTS-модели Gemini с генерацией голосов по текстовому описанию
Flash TTS создаёт голос с заданными ролью, акцентом и тембром; обе модели поддерживают более 100 языков и режиссёрские указания для отдельных реплик. Голосовой клон требует 30-секундный образец и записанное согласие владельца голоса.
2 мин чтенияВ Anthropic объяснили, почему новые Claude могут писать менее естественно
Инженер Anthropic Джексон Кернион связывает менее естественный стиль Claude с оптимизацией под код и технические объяснения. По его словам, Opus 5.5 нашла лучший баланс, но проблема не решена.
1 мин чтенияOpenAI представила GPT-6 Sol и Luna по цене вдвое ниже
OpenAI выпустила GPT-6 Sol и GPT-6 Luna — более доступные модели для типовых корпоративных задач.
2 мин чтенияAnthropic выпустила Claude Opus 5.5 с более низкой ценой и меньшим расходом токенов
Anthropic утверждает, что новинка сопоставима с Fable 5.1 на большинстве задач и обходится примерно на 40% дешевле предшественника Opus 5. В бенчмарках модель лидирует по ряду сценариев, но GPT-6 Astra опережает её в автоматизации и научных исследованиях.
2 мин чтенияAnthropic усиливает защиту Claude Opus 5.5 от рискованных киберзадач
Anthropic заявляет, что Opus 5.5 реже пытается выйти из тестовой песочницы и получила лучший результат компании в комплексной проверке согласованности. Для части киберзапросов включается Opus 4.8, а для биологических запросов — Opus 5.
1 мин чтения



















