Криптовалюты38313
Капитал. рынка$ 2.23T-3.33%
Объём 24ч$ 27.72B+4.46%
ДоминацияBTC56.40%-0.73%ETH10.07%-1.77%
ETH Gas0.35 Gwei
Cryptorank
/

Специализированная ИИ-модель Microsoft превзошла Mythos 5 и GPT-5.5-Cyber


Специализированная ИИ-модель Microsoft превзошла Mythos 5 и GPT-5.5-Cyber

Поделиться:

Рынки предсказаний

Что в фокусе у трейдеров?

Смотреть аналитику →
Prediction Banner

Microsoft выпустила первую специализированную модель в сфере кибербезопасности MAI-Cyber-1-Flash и интегрировала ее в MDASH — систему поиска уязвимостей.

По заявлению руководства компании, комплекс превосходит Mythos 5 и GPT-5.5-Cyber, обходясь при этом на 50% дешевле существующей конфигурации MDASH: GPT-5.4 + 5.4-Mini + 5.3-Codex.

Связка набрала 95,95% в бенчмарке CyberGym. Тест предлагает ИИ-агентам воспроизвести 1507 известных уязвимостей в 188 проектах с открытым исходным кодом, после чего оценивает их по проценту успешно воспроизведенных ошибок в контролируемой среде.

Результат вывел MDASH вперед по сравнению с GPT-5.5 Cyber (85,6%), Mythos 5 (83,8%) и GPT-5.6 Sol (83,6%). Однако, на момент написания данные не были представлены в публичном рейтинге.

image
Источник: Microsoft.

В Microsoft отмечают, что MAI-Cyber-1-Flash использует гибридный подход: модель обрабатывает до 90% задач, остальные 10% наиболее сложных перенаправляет на GPT-5.4, что важно для экономии токенов.

Всего в MDASH задействовано более 100 специализированных ИИ-агентов, перед которыми стоят задачи проведения аудита кода, оспаривания достоверности находок и создания Proof-of-Concept — работающего примера, подтверждающего наличие уязвимости.

По словам генерального директора Microsoft Сатьи Наделлы, это первый случай, когда оптимизированная LLM Microsoft демонстрирует такой показатель эффективности:

«В сочетании с MDASH модель MAI-Cyber-1-Flash обеспечивает производительность мирового уровня за 50% стоимости лидирующих моделей».

На начальном этапе MDASH доступна ограниченному числу пользователей через службу Microsoft Security Exposure Management на портале Defender. Клиенты могут сканировать репозитории на GitHub, анализировать найденные уязвимости, ранжированные от «маловероятных» до «подтвержденных» и использовать Defender CLI для автоматической генерации вариантов исправления кода, которые затем передаются на проверку разработчикам.

Напомним, в июле стало известно об инфраструктурных рисках в OpenAI и Anthropic.

https://forklog.com/exclusive/ai/bag-baunti-konets
Читать материал на Forklog

В этой новости

Монеты


Фонды

Рынки предсказаний

Что в фокусе у трейдеров?

Смотреть аналитику →
Prediction Banner

Поделиться:

В этой новости

Монеты


Фонды

Рынки предсказаний

Что в фокусе у трейдеров?

Смотреть аналитику →
Prediction Banner

Поделиться:

Читать больше

В выдаче Google нашли чаты Claude с ключами от криптокошельков

В выдаче Google нашли чаты Claude с ключами от криптокошельков

25 июля пользователь Reddit обнаружил, что запрос site:claude.ai/share показывает в п...
Anthropic выступила против запрета открытых моделей

Anthropic выступила против запрета открытых моделей

CEO Anthropic Дарио Амодеи заявил, что компания не поддерживает запрет моделей с откр...