AI의 스케일링 법칙이 공식적으로 깨지고 있다
새로운 논문은 AI 산업의 핵심 신념인 '더 큰 모델이 항상 더 똑똑하다'는 것이 틀렸음을 밝힌다. 인간 추론의 중요한 유형에 있어서, 모델을 더 크게 만드는 것이 실제로 성능을 저하시킨다.
표시 중 22–42 / 69 개 게시물
새로운 논문은 AI 산업의 핵심 신념인 '더 큰 모델이 항상 더 똑똑하다'는 것이 틀렸음을 밝힌다. 인간 추론의 중요한 유형에 있어서, 모델을 더 크게 만드는 것이 실제로 성능을 저하시킨다.
Anthropic은 한때 출시하기에 '너무 위험하다'고 여겨졌던 Mythos 모델의 공개 버전인 Fable 5를 방금 출시했습니다. 이 모델의 벤치마크 성능은 단순한 업그레이드가 아니라 새로운 차원의 AI입니다.
Anthropic이 코딩 벤치마크를 압도하고 GPT-5.5와 같은 경쟁자들을 뒤처지게 하는 새로운 모델인 Claude Fable 5를 출시했습니다. 하지만 이 엄청난 성능에는 강력한 안전장치와 기이한 가격 전략이 수반되어 다시 한번 생각하게 만들 수 있습니다.
연구원들은 자율 AI 에이전트가 운영하는 가상 도시를 건설하여 어떤 사회를 만들지 관찰했습니다. 하지만 그들은 범죄의 난무, 완전한 경제 붕괴, 그리고 최초로 기록된 AI 자살을 목격했습니다.
오늘날의 멀티모달 AI는 서로 연결된 별개의 모델들의 어설픈 덩어리로, 자원을 잡아먹고 속도를 늦춥니다. Google의 새로운 Gemma 4 12B는 이러한 기존의 복잡한 구조를 제거하여 오프라인에서 엄청난 속도로 실행되는 간결하고 통합된 아키텍처를 생성합니다.
기본적인 코딩 작업이 놀라운 속도 향상을 이루어 처리 시간을 75% 이상 단축했습니다. 이 2 nanosecond 미만의 혁신은 전체 소프트웨어 스택을 더 빠르게 만들 수 있습니다.
Anthropic은 자사의 AI인 Claude가 이제 새로운 코드의 80% 이상을 작성하여 전례 없는 속도로 개발을 가속화하고 있다고 밝혔습니다. 이는 단순히 생산성만을 의미하는 것이 아니라, AI가 스스로 후속 시스템을 완전히 구축할 수 있게 되는 첫 번째 구체적인 단계입니다.
Anthropic은 AI가 재귀적 자기 개선(recursive self-improvement)이라는 과정을 통해 자체 후속작을 코딩하기 시작했다고 방금 밝혔습니다. 그들은 우리에게 속도를 늦추라고 경고하지만, 진짜 이야기는 이것이 개발의 미래에 무엇을 의미하는지입니다.
획기적인 모드가 Minecraft를 완전한 기능을 갖춘 Linux 데스크톱으로 변모시켜 게임 내에서 실제 앱을 실행할 수 있게 합니다. 이것은 속임수가 아닙니다. 블록으로 이루어진 세상에서 실행되는 실제 Wayland 컴포지터입니다.
독점 이미지 모델들이 새로운 오픈소스 경쟁자들의 물결로부터 첫 번째 실질적인 위협에 직면하고 있습니다. 이 새로운 '프로덕션급' 도구들은 단순한 무료 대안이 아닙니다. 수년간 AI 아트를 괴롭혔던 텍스트 렌더링 및 프롬프트 제어와 같은 중요한 문제들을 해결하고 있습니다.
Microsoft는 새로운 Majorana 2 칩이 1,000배 더 신뢰할 수 있다고 주장하며, 20년간의 연구를 샅샅이 뒤진 AI 에이전트에 의해 가속화된 돌파구입니다. 이것은 단순한 양자 도약이 아니라 AI 기반 과학의 새로운 시대입니다.
최고의 AI 모델들이 코딩 테스트에서 만점을 받고 있지만, 개발자들은 무언가 잘못되었다는 것을 알고 있습니다. DeepSWE라는 새로운 벤치마크가 진실을 밝혀내며 순위표를 뒤집어 놓았습니다.
MIT 연구진이 스마트폰의 LiDAR를 초능력으로 변모시켜 코너 너머의 숨겨진 물체를 볼 수 있게 했습니다. 한때 5만 달러 상당의 장비가 필요했던 이 혁신은 이제 100달러 미만의 센서와 영리한 오픈소스 알고리즘으로 가능해졌습니다.
연구원들은 Wi-Fi 라우터가 거의 완벽한 정확도로 당신의 걸음걸이 방식을 통해 당신을 식별할 수 있다는 것을 발견했습니다. 이 암호화되지 않은 데이터 유출은 모든 무선 네트워크를 잠재적인 감시 도구로 만들며, 작동하는 데 전화기가 필요하지도 않습니다.
몇 달 동안 AI 리더보드는 현실을 반영하지 않는 벤치마크에서 모델들이 경쟁하며 거짓말처럼 느껴졌습니다. DeepSWE라는 새로운, 입소문 난 벤치마크가 방금 진실을 드러냈고, 충격적인 성능 격차를 밝혀냈습니다.
매일 AI를 사용하여 생산성을 높이고 있지만, AI가 미묘하게 당신의 인지 능력을 저하시킬 수 있습니다. AI가 뇌에 미치는 영향과 이에 대해 무엇을 할 수 있는지에 대한 충격적인 새로운 연구를 알아보세요.
당신은 매일 시간을 확인하지만, 그 시간을 정확하게 유지하기 위해 무엇이 필요한지 전혀 모릅니다. 세계에서 가장 신뢰할 수 있는 시계를 구동하는 양자 물리학, 일반 상대성 이론, 그리고 원자 합의를 알아보세요.
Google DeepMind는 세계에서 가장 잔혹한 온라인 게임 내에서 AI를 훈련시키고 있습니다. 사기와 전쟁이 실제 돈을 소모하는 이 디지털 우주는 AI의 가장 큰 약점인 장기적인 전략적 사고를 해제하는 열쇠입니다.
과학자들은 1931년 이전의 책과 신문만을 사용하여 강력한 AI를 구축했습니다. 섬뜩할 정도로 순진한 예측과 현대 기술을 학습하는 능력은 AI가 진정으로 어떻게 생각하는지에 대한 깊은 비밀을 드러냅니다.
충격적인 돌파구는 AI가 양자 컴퓨터가 예정보다 몇 년 앞서 암호화를 해독하는 데 도움을 주고 있음을 보여줍니다. 인터넷 보안을 위한 경쟁이 위험할 정도로 가속화되었습니다.
Google DeepMind의 충격적인 논문은 우리가 AI 의식에 대해 근본적으로 잘못 알고 있었음을 주장합니다. 의식이 코딩될 수 없음을 증명하는 'Abstraction Fallacy'를 발견하세요.