오픈AI, 차세대 모델 'GPT-6 아스트라' 공개하며 성능보다 안전성 설명에 주력
원문 보기 · AI타임스오픈AI가 GPT-6 아스트라를 공개하면서 이례적으로 성능 지표보다 안전성 설명에 발표의 중심을 뒀다. 시스템 카드에는 정렬 수준 외에 탈옥·프롬프트 인젝션 내성, 실제 컴퓨터 사용 시 행동 감시, 모델 사고 과정 공개 등이 포함됐다.
AI타임스 보도에 따르면 오픈AI는 GPT-6 아스트라 발표에서 벤치마크 성적 중심의 통상적 홍보 방식과 달리 안전성 테스트 결과를 별도로 공개하고 관련 인터뷰에서도 안전 문제를 반복적으로 설명했다. 공개된 시스템 카드에는 정렬 수준뿐 아니라 탈옥 및 프롬프트 인젝션에 대한 내성, 실제 컴퓨터 사용 과정에서의 행동 감시 체계, 모델의 사고 과정(추론 체인) 공개 여부 등이 포함됐다.
AI 모델의 시스템 카드는 오픈AI가 GPT-4 이후 도입해온 문서로, 모델의 능력과 한계, 위험 평가 결과를 공개하는 역할을 해왔다. 최근 에이전트형 AI가 실제 컴퓨터를 조작하는 기능을 갖추면서 프롬프트 인젝션이나 탈옥 같은 보안 취약점이 실무 리스크로 부각되고 있다.
보안·컴플라이언스 담당자는 시스템 카드에 명시된 탈옥 및 인젝션 내성 테스트 결과를 자사 도입 검토 시 참고 자료로 활용할 수 있으며, 특히 모델이 컴퓨터를 직접 조작하는 기능을 쓰는 업무 환경에서는 행동 감시 체계의 구체적 작동 방식을 확인할 필요가 있다. AI 거버넌스 담당 부서는 이런 공개 방식이 규제 대응이나 내부 위험 평가 문서 작성에 참고 사례가 될 수 있다.
발췌만으로는 시스템 카드에 담긴 구체적 테스트 수치나 제3자 검증 여부는 확인되지 않아 원문 확인이 필요하다.
본문은 수집한 기사의 제목과 발췌를 바탕으로 AI가 정리한 해설입니다. 원문 전체를 옮긴 것이 아니므로 수치·날짜·조문 등 세부 사실은 위 원문 링크에서 확인하세요. 개별 사안에 대한 법률·세무·노무·회계·의료 자문을 대체하지 않습니다.
기술·AI 실무를 강의로 이어서 학습하세요
읽은 주제를 실무 절차로 옮기는 과정은 전문가 강의에서 다룹니다. 분야별 커리큘럼과 수강 현황을 강의 페이지에서 확인할 수 있습니다.

