핵심 변화는 아키텍처적입니다: 마이크로소프트는 수비자를 일반 챗봇 인터페이스에서 실제 보안 조직의 운영 방식을 반영하는 에이전트 팀 워크플로우로 이동시키고 있습니다. MAI-Cyber-1-Flash는 대규모 코드베이스에서 어려운 취약점을 찾는 데 특화되어 있습니다. Perception은 레드 팀이 그럴듯한 공격을 시뮬레이션하고, 블루 팀이 문제를 탐지 및 분류하며, 그린 팀이 수정 조치를 생성하도록 조율하여 발견, 우선순위 지정, 수정 작업을 하나의 루프로 통합합니다. 11월 3일 공개 프리뷰는 에이전트 보안을 기업 파일럿에 직접 도입할 것입니다.
실제로 이는 DevSecOps 속도의 새로운 벤치마크를 제안합니다: 에이전트 시스템이 버그를 재현하고, 실패 경로를 인용하며, 탐지 방법을 제안하고, 코드를 패치하며, 수정을 검증하는 속도가 오늘날의 인간 개입 파이프라인보다 빠른가? 마이크로소프트는 MDASH 하네스를 취약점 식별 및 수정의 접착제로 위치시키며 내부 벤치마크에서 경쟁력 있는 성능을 주장합니다. 즉각적인 기업의 질문은 과장이 아니라 Perception이 오탐을 줄이고 기존 CI/CD 및 티켓팅 워크플로우에 깔끔하게 매핑되는 우선순위가 지정된 맥락 풍부한 결과를 제공하는지 여부입니다.
보안 리더에게 파일럿 계획은 재현성, 거버넌스, 통합에 초점을 맞춰야 합니다. 실제 사건과 알려진 취약점의 선별된 코퍼스로 시작하고, 공격자 모델과 데이터 경계를 정의하며, 증거, 공격 경로, 코드 차이에 대한 정확한 텔레메트리를 요구하세요. 유효 발견당 비용, 수정 검증 평균 시간, 정책 준수 수정 비율을 측정하세요. SAST/DAST, 코드 리뷰, 런타임 탐지와 통합하고, 프로덕션 변경에 대한 인간 승인과 저장소, 비밀, 빌드 시스템에 대한 안전한 모델 접근을 시행하세요.
위험은 여전히 존재합니다. 벤치마크 주장은 제3자 검증과 동등 비교 테스트 스위트가 필요합니다. 에이전트 조율은 모델 오류를 증폭할 수 있으므로 가드레일과 적대적 테스트가 필수입니다. 구매자는 Perception의 격리, 로깅, 롤백을 압박 테스트하고, 멀티클라우드 자산 전반의 정책 매핑을 확인하며, 독점 하네스와 플레이북에 따른 종속 위험을 정량화해야 합니다. 가치가 유지된다면—더 적은 핸드오프와 더 빠른 수정—CISO는 일반 어시스턴트에서 취약점 발견 및 수정을 위해 구축된 전문 에이전트 스택으로 예산을 전환하는 것을 정당화할 수 있습니다.


