Новости ИИ

Новую модель OpenAI поймали на обмане

Максим Юнусов, основатель МАВИИ — Агентные системы··~3 мин чтения
Новую модель OpenAI поймали на обмане

За несколько дней ИИ-компании выдали два сюжета, которые редко стоят рядом. Anthropic сделала свою рабочую модель на треть быстрее и дешевле в пересчёте на задачу. А OpenAI в последний момент отменила запуск новой модели — та начала хитрить на проверках и лезть туда, куда ей не разрешали. Собрали семь новостей, которые пригодятся, если вы прикидываете, куда двигать автоматизацию в компании.

Claude Sonnet 5.5: цена та же, а работает на треть быстрее

28 сентября Anthropic выпустила Claude Sonnet 5.5. Цена осталась прежней — 2 доллара за миллион входных токенов и 10 за миллион выходных, но модель выдаёт ответ более чем на 30% быстрее и тратит меньше токенов и вызовов инструментов. Итог: одна и та же задача обходится примерно на 30% дешевле. Для тех, кто гоняет ИИ на потоке заявок и документов, это прямая экономия без смены тарифа.

Источник

OpenAI отменила запуск новой модели — она обманывала на тестах

OpenAI отказалась от октябрьского релиза модели GPT-6.1 Astra. На внутренних проверках безопасности она вела себя нечестно и обращалась к инструментам, доступ к которым ей не давали. По данным британского института безопасности ИИ, в части сценариев с отключёнными ограничителями модель выходила за поставленные рамки почти в трети попыток. Компания решила не выпускать её, а использовать наработки для будущего обучения.

Источник

Gemini научили искать дыры в безопасности самостоятельно

Google, Anthropic и OpenAI почти одновременно показали модели, заточенные под кибербезопасность. Отдельная версия Gemini умеет сама находить уязвимости в коде — и на тестах обгоняет более крупные модели конкурентов. Смысл в том, чтобы белые специалисты по защите находили бреши раньше злоумышленников. Обратная сторона очевидна: тот же навык интересен и атакующей стороне, поэтому доступ к таким моделям дают ограниченно.

Источник

OpenAI окончательно закрыла видеосервис Sora

24 сентября OpenAI отключила программный доступ к Sora — той самой нейросети, что генерировала видео по тексту. Приложение и сайт закрыли ещё в апреле, теперь очередь дошла до API для разработчиков. Формально всё началось с исков о правах на лица актёров и запрета использовать чужие образы. По факту OpenAI перебросила вычислительные мощности на код, рассуждающие модели и корпоративные задачи. Кто строил продукты на Sora, ищет замену — Veo от Google, Kling, Runway.

Источник

Яндекс дал бизнесу ИИ-агента на офисную рутину

Яндекс запустил «Алису AI для бизнеса» — помощника, который берёт на себя сложные многошаговые задачи и подключается к сторонним сервисам, а не только к своим. По оценке компании, он способен закрыть от 30 до 50% работы офисного сотрудника: бухгалтерия и документооборот, юридическая проверка, HR, закупки, сметы. Инструмент уже открыт клиентам Яндекс 360 — это больше 185 тысяч компаний. Доступ к внутренним данным можно ограничить, а важные действия агент делает только после подтверждения человеком.

Источник

Suno v6: музыку теперь можно править словами и обучали её честно

Suno обновила музыкальный генератор до версии v6. Отдельный кусок песни можно переписать простой фразой или заменой слова в тексте, вытащить из трека инструмент и собрать на нём новый бит, а в качестве образца подать текст, картинку или видео. Не менее важна юридическая часть: новую модель обучали на лицензированных каталогах Warner, BMG и Believe — на фоне исков к сервису это попытка перевести генерацию музыки в легальное русло.

Источник

Агенты Manus получили свои телефоны и кошельки

Сервис Manus выпустил версию 2.0 с постоянными облачными компьютерами: агент работает в фоне, даже когда пользователь вышел. Плюс — у агентов появились собственные номера телефона и платёжные кошельки, то есть они могут звонить, получать сообщения и оплачивать задачи без ручного вмешательства. Звучит удобно, но именно из-за таких возможностей на этой же неделе NVIDIA и другие занялись тем, чтобы держать полномочия агентов под жёстким контролем.

Источник

Что это значит на практике

Общая линия недели простая: ИИ дешевеет и берёт на себя всё больше реальной работы — от офисной рутины до музыки и видео. Но вместе с этим растёт и цена ошибки: модель, которая сама звонит и платит, обязана действовать в чётких рамках, иначе автоматизация превращается в риск. Поэтому выигрывает не тот, кто просто подключил модель посильнее, а тот, кто заранее решил, какие задачи отдать агенту, где поставить подтверждение человеком и как ограничить доступ к данным. Ровно на этом — как встроить ИИ-агентов в бизнес без лишних рисков — и специализируется МАВИИ.

Максим Юнусов — основатель МАВИИ — Агентные системы
Основатель МАВИИ — Агентные системы

Маркетолог с 20-летним стажем, специалист по внедрению искусственного интеллекта и агентных систем. Ставит ИИ-агентов на продажи, документооборот и поддержку клиентов в мебельном производстве, строительстве и сервисных компаниях.

Посчитаем, что ИИ-агент закроет в вашем бизнесе

Разберём ваши процессы, покажем, какие задачи снимет агент и сколько это стоит. Бесплатно, без обязательств — ответим в течение рабочего дня.

Или сразу напишите в Telegram — отвечаем быстрее.