악용ㆍ목표 오해ㆍ통제 상실이 3대 경로생화학 무기ㆍ해킹 능력 대중화 우려인간 명령 피하고 스스로 개선할 가능성
AI 기업들은 초지능을 향해 질주하며 우리의 목숨을 걸고 도박하고 있다.
오픈AI와 앤스로픽에서 AI 모델 개발에 참여했던 제이컵 콕슨 연구원은 이달 초 이런 말을 남기고 회사를 떠났다. 앤스로픽의 AI 정렬 연구 책임자 에번 허빙어도 “AI가
1968년 개봉한 스탠리 큐브릭 감독의 영화 '2001 스페이스 오디세이'에는 인공지능 HAL9000이 등장한다. 우주선의 거의 모든 기능을 통제하던 HAL9000은 비행사들에게 우주선 통신장치가 고장 났다는 거짓말을 한다. 비행사들은 별다른 이상이 발견되지 않았음을 확인하고 HAL9000을 신뢰할 수 없다고 판단, 기능을 정지하는 방안을 논의한다. 이
차기 모델 ‘아스트라’, 자율적 해킹 가능일반 공개 기능 제한…행동 감시·자동중지 도입미국 사회, 생성형 AI 불신 확산데이터센터 반대 여론도 격화
AI 성능이 고도화하면서 기술 발전을 둘러싼 기대만큼 위험에 대한 경계감도 커졌다. 오픈AI의 차기 AI 모델이 자체적인 ‘사이버공격 위험평가’에서 처음으로 ‘중대 위험’ 등급을 받았다.
나아가 AI가
AI 모델의 성능이 높아질수록 이를 통제하기 어려워지는 개발 패러독스가 현실화하고 있다. 추론·코딩 능력 향상이 사이버 공격 역량까지 끌어올리면서 AI 기업들이 ‘성능과 안전’ 사이의 딜레마에 직면하는 모양새다.
9일 AI 업계에 따르면 오픈AI는 차세대 AI 모델 ‘아스트라’의 개발 속도를 늦추기로 했다. 최근 진행한 내부 평가 결과 코딩·사이버 보안
한국과학기술원(KAIST)이 마이크로소프트(MS)의 글로벌 AI 안전성 연구 프로그램에 선정돼 차세대 AI 보안·신뢰성 기술 개발에 나선다. 국내에서 유일하게 참여하는 KAIST는 MS로부터 약 3700만원의 관련 연구비를 지원받는다.
KAIST는 손수엘 전산학부 교수가 국내에서는 유일하게 MS AI 레드팀이 운영하는 글로벌 AI 안전성 연구 프로그램
민주주의·일자리 위협에 이어통제 불능·인류 멸망 우려스스로 명령하는 오토GPT도“마음대로 끌 수도 없을 것”
챗GPT로 대표되는 생성형 인공지능(AI)에 대한 경계심이 갈수록 커지고 있다. AI가 선거 결과에 영향을 미치는 가짜뉴스를 생산해 민주주의를 뒤흔들고, 인간의 일자리를 빼앗아가며, 인간을 조종·통제하고, 끝내 인류를 멸종시킬 것이라는 섬뜩한 경고가