
마이크로소프트는 MAI-Cyber-1-Flash가 포함된 MDASH가 표준 벤치마크 테스트인 CyberGYM에서 96%의 점수를 받았다고 밝혔습니다. 평점은 Anthropic의 Mythos보다 12포인트 높으며 Google Gemini 및 OpenAI GPT도 능가합니다. 새로운 MDASH는 이전 MDASH 제품에 비해 사용 비용이 절반입니다.
Microsoft가 월요일에 발표한 두 번째 도구는 Project Perception입니다. 또한 취약점을 찾고, 위험을 파악하기 위해 조사하고, 시정 조치를 취하기 위해 레드팀, 블루팀, 그린팀 기능을 각각 수행하는 전문 AI 에이전트 모음입니다. 마이크로소프트는 플랫폼이 할당된 작업에 따라 사용할 모델을 선택한다고 말했습니다. 결정 시 고려해야 할 사항에는 모델의 효율성과 고객이 부담하는 최종 비용이 포함됩니다. 마이크로소프트는 이번 결정이 “최초 및 전문 모델에 대한 지속적인 연구, 벤치마킹, 평가”를 통해 이루어진다고 밝혔다.
Microsoft는 Project Perception이 경쟁사의 유사한 플랫폼보다 저렴한 비용으로 작업의 90%를 수행하도록 설계되었다고 밝혔습니다. 이는 고객이 나머지 10%의 작업에 대해서만 더 비싼 대안으로 전환할 수 있음을 의미합니다.
마이크로소프트는 새로운 도구가 조직이 치명적인 해킹으로부터 네트워크를 보호하는 방식의 엄청난 변화에 대응한다고 말했습니다.
“AI가 사이버 공격의 속도와 규모를 가속화함에 따라 방어자들은 다른 시대에 맞게 구축된 접근 방식으로 점점 더 복잡해지는 디지털 환경을 보호해야 한다는 요구를 받고 있습니다.”라고 회사는 말했습니다. “보안팀은 방대한 양의 데이터에 걸쳐 신호, 상황, 위험 통찰력을 통합해야 하는 경우가 많으며 이로 인해 새로운 위협에 대응하기가 더 어려워집니다.”
지난주의 OpenAI 사건으로 인해 가장 디스토피아적인 공상 과학 소설에서 튀어나온 문제적인 장면이 등장하면서 현재 미리 보기 모드에 있는 도구는 Microsoft가 언급하지 않은 건전한 주의를 기울일 가치가 있습니다. 생산에 사용하기 전에 면밀히 조사하고 평가해야 합니다. 반면에, 그러한 도구를 채택하지 않으면 분명한 위험이 따릅니다. AI 에이전트 사용에 따른 위험과 이를 피하는 위협 사이의 균형을 맞추는 작업은 현재로서는 명확한 답이 없는 작업입니다.
이 주제에 대해 더 알고 싶다면 아래를 참고하세요