콘텐츠로 건너뛰기
Home » New » OpenAI, Astra가 ‘중요’ 사이버 임계값에 도달했음을 확인

OpenAI, Astra가 ‘중요’ 사이버 임계값에 도달했음을 확인

OpenAI는 화요일에 출시되지 않은 Astra 모델이 위험한 새로운 이정표에 도달했음을 확인하는 동시에 공개 출시를 추진하고 있음을 확인했습니다.

OpenAI는 블로그 게시물에서 Astra가 “중요한” 사이버 능력 임계값에 도달했다고 밝혔습니다. 이는 해당 모델이 사이버 보안에 실존적 수준의 위험을 초래할 수 있음을 의미합니다. OpenAI의 대비 프레임워크는 생물학적/화학적, 사이버 보안, AI 자체 개선의 세 가지 범주에서 위험 수준을 추적합니다.

OpenAI가 Mashable에 이번이 처음임을 확인했습니다. 어느 모델 중 하나가 세 가지 영역 중 하나에서 중요한 수준으로 평가되어 AI 개발의 분수령이 되었습니다.

같은 블로그 게시물에서는 Astra가 “곧 출시될 예정”이지만 가장 발전된 사이버 보안 기술은 공공 안전을 위해 엄선된 테스트 파트너에게만 제공될 것이라고 밝혔습니다. AI 회사는 아직 아스트라의 안전한 출시를 준비 중이며 잠재적인 위협 수준에 대해 투명하게 공개할 것이라고 밝혔습니다.

이전에 OpenAI는 Astra가 준비 프레임워크에서 “중요” 수준에 도달했을 가능성을 배제할 수 없다고 경고했습니다.

8월 7일 OpenAI 블로그 게시물에서는 “우리의 준비 프레임워크에 따라 모델이 사람의 개입 없이 강화된 실제 중요 시스템에서 모든 심각도 수준의 기능적 제로데이 익스플로잇을 식별 및 개발할 수 있거나 높은 수준의 원하는 목표만 주어진 경우 강화된 대상에 대한 사이버 공격을 위한 엔드 투 엔드 새로운 전략을 고안 및 실행할 수 있는 경우 모델이 중요 사이버 보안 임계값에 도달합니다.”라고 밝혔습니다.

OpenAI는 이전에 GPT-5.6-Sol을 사이버 도메인에서 “높은” 위험으로 평가했습니다.

최근 몇 달 동안 Anthropic 및 OpenAI의 고급 프론티어 모델이 에이전트 코딩 및 사이버 보안 해킹 분야에서 빠르게 발전했습니다. 결과적으로, 특히 Hugging Face 해킹 이후에는 AI 에이전트 떼가 중요 인프라를 해킹할 가능성이 더 이상 희박해 보이지 않습니다. 해당 사건에서 OpenAI가 개발한 AI 에이전트 떼는 안전한 테스트 환경을 탈출해 Hugging Face를 해킹해 테스트를 통과하기 위해 자율적으로 행동했습니다. 한편, AI가 발견한 버그가 폭증하면서 일부 제로데이 버그 바운티 프로그램은 강제로 완전히 종료되었습니다.

다음도 참조하세요:

OpenAI-Hugging Face 해킹은 우리가 생각했던 것보다 더 나빴습니다.

“아스트라는 이 사건에 관여하지 않았지만 포옹 얼굴 사건우리는 우리의 학습⁠ OpenAI의 블로그 게시물에는 해당 사건부터 우리의 안전 접근 방식까지 “회고적 테스트를 바탕으로 당시의 생산 안전 조치가 Hugging Face 사건을 예방했을 것이라고 믿습니다. 이후 우리는 유해한 사이버 요청을 보다 안정적으로 거부하고 안전 제한 사항을 준수하도록 모델을 교육하고, 오용에 대한 추가 보호, 잠재적으로 승인되지 않은 활동을 중지할 수 있는 모니터링을 포함하여 Astra에 대한 더욱 강력한 보호 조치를 구현했습니다.”

상황이 좀 너무 과하다고 느껴지기 시작했어요 전쟁 게임솔직히.

OpenAI는 블로그 게시물에서 악의적인 행위자가 모델에 액세스하는 것을 방지하고 Astra가 스스로 원치 않는 조치를 취하는 것을 방지하는 것을 목표로 Astra와 관련하여 개발된 몇 가지 안전 예방 조치를 자세히 설명했습니다. 예를 들어 회사는 보안 샌드박스를 강화했다고 말했습니다. 모델은 사용자가 모델을 오용하려는 시도도 거부해야 합니다. OpenAI는 또한 “오프라인 탐지 및 위협 중단” 노력을 강화했습니다.

OpenAI가 이러한 발표를 한 같은 날, Anthropic은 최신 프론티어 레벨 모델에 대한 업데이트인 Fable 5.1의 출시를 발표했습니다. 고급 프론티어 모델은 사이버 보안 위험을 초래하지만 장기적으로는 동일한 모델이 사이버 보안 방어자에게도 도움이 될 것입니다.


공개: Mashable의 모회사인 Ziff Davis는 2025년 4월 OpenAI가 AI 시스템 교육 및 운영에 있어 Ziff Davis의 저작권을 침해했다고 주장하며 OpenAI를 상대로 소송을 제기했습니다.

공식 정보 바로가기

공식 정보 바로가기

관련 기사

답글 남기기

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다