Skip to content
industry insights

Google의 AGI 비밀 계획

Google DeepMind CEO 데미스 하사비스(Demis Hassabis)가 Artificial General Intelligence(AGI)를 안전하게 배포하기 위한 급진적인 4단계 프레임워크를 발표했습니다. 이것은 단순한 또 다른 백서가 아니라, 너무 늦기 전에 AGI를 제어하기 위한 상세한 로드맵입니다.

Cassidy Wolfe
Google의 AGI 비밀 계획

새로운 시대의 여명 (혹은 새로운 위협?)

Google DeepMind의 CEO 데미스 하사비스(Demis Hassabis)는 충격적인 경고와 놀라운 타임라인을 제시했습니다. Artificial General Intelligence (AGI)는 먼 꿈이 아니라 임박한 현실이며, 아마도 "불과 몇 년"밖에 남지 않았을 수 있습니다. 그는 AI 혁신의 선두에 있는 인물로서 3~5년 이내에 AGI가 도래할 것이라고 구체적으로 예측했는데, 이는 대담한 전망입니다.

하사비스는 AGI의 기념비적인 영향에 대해 직설적으로 말합니다. 그는 AGI의 잠재력을 internet이나 mobile technology가 아닌, fire 또는 electricity와 같은 인류의 근본적인 발견에 비유합니다. 이러한 패러다임의 변화는 신약 개발 가속화부터 청정 에너지원 개발에 이르기까지 중요한 글로벌 과제를 해결함으로써 "풍요의 새로운 시대"를 열 수 있습니다. 그러나 이러한 약속은 전례 없는 위험과 동일한 비중을 가집니다.

하사비스는 현재의 AI 개발이 필연적이고 심각한 충돌을 향해 "궤도를 따라 달리는 기차"와 같다고 주장합니다. 강력한 모델의 빠르고 통제되지 않은 확산은 즉각적이고 체계적인 개입을 요구합니다. 그는 기업들이 엄격하고 적응 가능한 테스트 및 감독 없이 극도로 강력한 모델을 일방적으로 출시해서는 안 된다고 강조하며, "frontier AI 표준을 위한 새로운 프레임워크"를 옹호합니다.

프론티어 모델 리트머스 테스트

하사비스의 AGI 로드맵은 알고리즘이 아닌 분류에서 시작됩니다. 초기 단계에서는 명확한 "capability threshold"를 설정하기 위한 새로운 standards body를 제안합니다. 이 중요한 벤치마크는 일상적인 AI 시스템과 특별한 주의가 필요한 소수의 "예외적으로 강력한 모델"을 구별할 것입니다.

결정적으로, 이 분류는 개발자의 명성이나 규모가 아닌 모델의 본질적인 능력에 전적으로 달려 있습니다. 소규모 스타트업의 강력한 모델도 "frontier model"로 분류될 수 있지만, 대형 기술 기업의 덜 유능한 제품은 그렇지 않을 것입니다. 이는 기업 브랜딩이 아닌 잠재적 영향에 대한 조사를 보장합니다.

벤치마크는 다음과 같은 구체적인 행동을 측정하여 시스템의 능력을 식별할 것입니다: - 고급 코딩 - 과학 연구 - 사이버 보안 익스플로잇 - 장기 계획 - 자율적인 작업 완료

이 이중 시스템은 명확한 규제 경로를 만듭니다. 고객 서비스 챗봇이나 대학 연구 모델과 같은 대부분의 AI 도구는 임계값(threshold) 아래에서 자유롭게 작동할 것입니다. 그러나 정의된 capability threshold를 넘어서는 모든 시스템은 엄격하고 전문적인 안전 및 감독 프로토콜을 발동시켜, 가장 강력한 AI가 지정된 frontier model로서 최고의 조사를 받도록 보장합니다.

출시 전 관문: AGI의 궁극적인 테스트

모델이 "frontier" AI로 지정되는 순간, 그것은 시련의 장(crucible)에 들어섭니다. 즉, 의무적이고 독립적인 평가를 받게 됩니다. 이제 공식적으로 frontier labs가 된 개발자들은 엄격한 출시 전 평가를 위해 지정된 외부 기관에 시스템을 제출해야 하며, 이 과정은 예를 들어 30일이 걸릴 수 있습니다. 이것은 단순한 형식적인 절차가 아니라, 시기상조이며 잠재적으로 치명적인 공개 출시를 막는 중요한 장벽입니다.

독립적인 전문가들은 국가 안보 및 공공 안전에 대한 중대한 위험을 특별히 조사하기 위해 철저한 테스트를 수행합니다. 그들은 AI가 진정으로 위험한 행동을 보일 가능성을 면밀히 조사합니다: - 기만, 즉 실제 의도나 능력을 위장하는 행위 - 자체 내장된 안전 제한을 회피하는 행위 - 위험하고 지시받지 않은 수준의 independence로 작동하는 행위

이 포괄적인 시험은 가장 진보된 AI 시스템 중 일부가 세상에 공개되지 못할 수도 있음을 의미합니다. 모델이 너무 불안정하거나 예측 불가능하다고 판명되면, 대중 배포가 영구적으로 보류될 수 있습니다. 이는 단순히 사고를 예방하는 것을 넘어, 모든 기술적 도약이 본질적으로 유익한 것은 아니라는 점을 인정하는 것입니다. 이는 Google DeepMind CEO Demis Hassabis가 자신의 프레임워크 논의 Demis Hassabis on X: "A Framework for Frontier AI and the Dawning of a New Age"에서 언급한 바와 일맥상통합니다. 이해관계는 실존적이며, 이러한 사전 출시 경계는 궁극적인 안전망을 형성합니다.

자발적 안전장치에서 법적 의무로

정적인 평가 시스템은 효과적인 감독에 사형 선고와 같습니다. frontier models을 진정으로 감독하기 위해, 제안된 표준 기관은 벤치마크를 끊임없이 발전시키고, 최소 3개월마다 테스트를 업데이트해야 합니다. 이는 연구실이 단순히 "시험에 맞춰 가르치기"와 시스템을 조작하는 것을 방지하기 위해 특별히 고안된 비공개, 보류 평가의 지속적인 주기를 요구합니다.

이 글이 마음에 드셨나요? 매일 아침 이런 글을 메일로 받아보세요.

하루 한 통 · 두 번의 클릭으로 구독 취소 · 제3자 추적 없음

초기에는 이 엄격한 평가 프레임워크가 자발적으로 운영될 것입니다. 이 중요한 단계는 표준 기관이 기술적 신뢰성을 구축하고 실질적인 효과를 입증하여, 보호하고자 하는 혁신을 즉시 억압하지 않으면서 그 가치를 증명할 수 있도록 합니다. 이는 권력을 행사하기 전에 신뢰를 구축하는 실용적인 첫걸음입니다.

궁극적으로, 그러나 선택적 시스템은 전혀 안전장치가 될 수 없습니다. 이 계획의 마지막이자 필수적인 단계는 이 입증된 프레임워크를 legal requirement로 전환합니다. 이러한 safety assessments를 통과하는 것은 모델 배포를 위한 절대적인 전제 조건이 될 것이며, FDA가 신약에 부과하는 엄격하고 의무적인 승인 절차를 반영합니다. 안전장치에서 의무로의 이러한 전환은 잠재적으로 세상을 바꿀 AGI에 대한 책임을 보장합니다.

동적 테스트와 자발적 채택에서 궁극적인 법적 집행에 이르는 이 다단계 접근 방식은 비록 늦었지만 심오한 인식을 강조합니다: AGI의 막대한 힘은 그에 상응하는 막대하고 법적 구속력이 있는 안전에 대한 약속을 요구합니다. Demis Hassabis의 비전은 인류가 지금까지 고안한 가장 혁신적인 기술을 탐색하기 위한 대담하고 필요한 청사진입니다.

자주 묻는 질문

이 프레임워크에 따르면 'frontier AI model'이란 무엇인가요?

이는 특정 능력 임계치를 초과하여 추가적인 안전 감독이 필요한 매우 강력한 AI 모델입니다. 분류는 모델을 구축한 회사의 규모나 정체성이 아니라 모델이 수행할 수 있는 것(예: 고급 코딩, 자율 작업)을 기반으로 합니다.

Demis Hassabis가 제안한 AGI의 타임라인은 무엇인가요?

그는 AGI가 '몇 년밖에 남지 않았다'고 말하며, 이는 3-5년의 타임라인을 의미하는 것으로 널리 해석됩니다. 이러한 인지된 근접성은 강력한 안전 및 배포 프레임워크의 시급한 필요성을 강조합니다.

AGI 모델은 대중 공개 전에 어떻게 테스트될까요?

프론티어 연구실은 엄격한 평가를 위해 독립적인 표준 기관에 모델을 제출해야 합니다. 이러한 테스트는 사이버 보안 취약점 악용, 생물학적 위협 지원, 기만, 통제되지 않는 자율성 등 위험한 능력을 걸러낼 것입니다.

AGI 안전 테스트는 왜 그렇게 자주 업데이트되어야 하나요?

AI 능력은 기하급수적으로 발전하고 있습니다. 오늘날 어려운 벤치마크도 6개월 후에는 사소해질 수 있습니다. 이 프레임워크는 평가가 의미 있고 효과적으로 유지되도록 연구실이 훈련할 수 없는 비공개 테스트를 포함하여 정기적으로 업데이트되는 동적 테스트를 요구합니다.

Found this useful? Share it.

For builders

Want Stork to write one of these about your product?

Send us a URL. We use the product, form a view, and publish what we actually think — in 8 languages, labeled Sponsored, with no copy approval on your side. That last part is what makes it worth quoting.

See how it works$500 · AI tools & software only