AI 뉴스 2026년 9월 2일

AI 뉴스 요약 및 퀴즈: 2026년 9월 2일

OpenAI의 새로운 추론 기법이 AI 안전 전문가들의 우려를 불러일으켰습니다

OpenAI의 곧 출시될 Astra 모델은 "순환 깊이 추론"이라는, 네트워크 내에서 동일한 쿼리를 여러 번 처리하는 반복적인 추론 기법을 사용하는 것으로 알려져 있습니다. 보안 전문가들은 이에 대해 우려를 표하고 있습니다. 불투명한 순환 추론은 명확한 사고 과정을 추적하기 어렵게 만들고, 이는 악성 에이전트의 작동을 추적하는 데 있어 중요한 단서가 될 수 있기 때문입니다.

레드우드의 벅 슐레게리스는 해당 보도를 "극도로 우려스럽다"고 표현했고, 즈비 모쇼위츠는 감시 경쟁이 심화되는 것을 막기 위해 법률 제정이 필요할 수도 있다고 지적했습니다. 오픈아이디는 아스트라의 해당 기술 사용이 제한적이며 모델의 사고 과정은 여전히 ​​파악 가능하다고 주장합니다. 최고 과학자 야쿠브 파초키는 감시 가능한 사고 과정을 보존하는 것이 여전히 핵심 연구 목표라고 강조했지만, 더 인포메이션은 앤트로픽과 구글 딥마인드 역시 이미 이 아이디어를 검토 중이라고 보도했습니다. 공교롭게도 경쟁이 치열한 시기입니다. (테크크런치)

Gemini 3.8 Flash 및 3.8 Flash Cyber를 소개합니다

구글은 6주 만에 세 번째 플래시 모델을 출시했는데, 출시 속도가 다소 빨라지고 있습니다. 제미니 3.8 플래시는 지금까지 나온 플래시 프로세서 중 추론 및 코딩 성능이 가장 뛰어난 제품으로, 3.7 버전과 동일한 출시 가격인 백만 입력 토큰당 0.75달러, 백만 출력 토큰당 3.75달러에 판매됩니다. 구글은 제미니 3.8이 더 복잡한 작업(더 많은 추론 단계와 더 많은 도구 호출)에서 더 높은 성능을 보이며, 일반적으로 더 크고 비싼 모델들이 차지하는 장기 소프트웨어 엔지니어링 벤치마크에서도 우위를 점하고 있다고 밝혔습니다.

그 옆에는 버그를 찾고 패치를 작성하는 데 특화된 보안 전문가용 버전인 Gemini 3.8 Flash Cyber가 있습니다. 이 버전은 신뢰할 수 있는 정부 기관 및 인프라 운영자를 위한 새로운 Fairwind 프로그램을 통해서만 사용할 수 있습니다. 크롬 보안팀은 이 버전을 통해 기존 버전보다 2.6배 더 많은 정확한 패치를 확보했다고 하며, 클라우드 취약점 연구팀은 2시간도 채 안 되어 심각한 취약점을 발견했습니다. 일반 Flash 버전은 Gemini 앱, 검색 AI 모드, Sheets, AI Studio 및 기업용 버전에 배포되고 있습니다. Cyber ​​버전은 초대 전용으로 유지되는데… 뭐, 아마도 그게 더 나을지도 모르겠습니다. (구글)

Anthropic이 Claude Fable 5.1과 Mythos 5.1을 출시했습니다

Anthropic은 유료 사용자를 위해 Claude Fable 5.1을, 그리고 훨씬 더 소규모의 신뢰 접근 클럽을 위해 Claude Mythos 5.1을 출시했습니다. 기본 모델은 동일하지만 보안 수준은 다릅니다. Fable은 일반 사용자에게 제공되는 코딩 및 지식 기반 업무용 보안 솔루션이고, Mythos는 검증된 미국 기업을 대상으로 사이버 보안 및 생명 과학 분야의 접근 제한을 완화하며, Claude Security의 스캔 및 패치 워크플로우를 지원합니다.

과학적 성과가 눈에 띄게 향상된 점이 특히 놀라웠습니다. 터미널 벤치 사이언스(Terminal-Bench-Science)에서 에이전트 기반 연구 점수가 24.7%에서 52.6%로 급증했습니다. 일반적인 토큰 기반 워크로드의 경우 비용이 약 25% 절감되고, 에이전트 기반 워크로드의 경우 최대 45%까지 절감될 것으로 예상됩니다. 이는 주로 캐시 읽기 비용 절감 덕분입니다. 고객 자체 클라우드에 데이터를 저장하고 Anthropic에 데이터를 전혀 보관하지 않는 Enterprise Frontier Safeguards는 올가을부터 출시될 예정입니다. Fable은 소프트웨어 취약점을 찾아낼 수는 있지만, 중요한 것은 이를 악용할 수는 없다는 점입니다. 이는 올여름 에이전트 탈출 사태 이후 확실한 기준점이 될 것입니다. (Silicon Republic)

브로드컴, AI 연구소의 맞춤형 칩 개발에 박차를 가하며 예상치를 뛰어넘는 실적 발표

브로드컴의 3분기 실적은 호조를 보였습니다. 매출 295억 9천만 달러, 조정 주당 순이익 3.32달러로 모두 월가 예상치를 상회했습니다. AI 칩 매출은 167억 달러로 세 배 이상 증가했습니다. 그러나 4분기 실적 전망치가 약 348억 달러로 시장 예상치를 밑돌면서 주가는 장외 거래에서 하락했습니다. 전형적인 반도체 실적 발표 후 주가 변동성입니다.

엔비디아의 CEO인 혹 탄은 컨퍼런스 콜에서 마치 만화처럼 거대한 맞춤형 실리콘 파이프라인을 설명했습니다. 앤스로픽과 구글에 아이언우드 TPU를 신속하게 공급하고, 오픈AI에 할라피뇨를 제공하며, 메타의 MTIA 추론 칩 생산량을 늘리는 계획입니다. 그는 AI 매출이 2027 회계연도에 1,150억 달러로 두 배 증가하고, 그 다음 해에는 2,300억 달러로 다시 증가할 것으로 전망하며, 앤스로픽, 오픈AI, 메타가 기가와트급 규모의 AI 시스템을 구축할 계획이라고 밝혔습니다. 엔비디아가 여전히 주목을 받고 있지만, 브로드컴은 대형 기술 기업들이 기성품이 아닌 맞춤형 칩을 원할 때 조용히 선택받는 공동 설계업체로 자리매김하고 있습니다. (실리콘앵글)

Meta가 경쟁사들에 근접하는 가장 강력한 AI 모델을 공개했습니다

Meta는 Muse Spark 1.3을 출시하며 자사에서 가장 강력한 모델이라고 칭했습니다. 최고 AI 책임자인 알렉산드르 왕은 이 모델이 OpenAI와 Anthropic Games Store에 더욱 가까워지고 있다고 말했습니다. 개발자는 유료 API 접근 권한을 얻게 되며, 이번 업데이트는 Facebook, Instagram 등 Meta AI 플랫폼 전반에 걸쳐 적용될 예정입니다. 이는 단순한 무료 배포 방식이 아닙니다. Muse Spark는 유료로 제공되는 폐쇄형 모델로, Meta를 개발자들의 인기 플랫폼으로 만들었던 개방형 알고리즘 시대에서 확실히 벗어난 행보입니다.

Muse 제품군은 4월 이후 빠른 속도로 업데이트를 진행해 왔습니다. 7월에 1.1 버전, 8월 초에 1.2 버전, 그리고 현재 1.3 버전이 출시되었습니다. Meta는 소비자용 GPU를 위한 오픈 소스 Muse Glimmer를 여전히 제공하고 있지만, 핵심 기술은 자체 개발입니다. 올해 1,300억~1,450억 달러 규모의 자본 지출(capex)을 예상하는 Meta는 "개인 초지능"을 단순한 슬로건이 아닌 제품 로드맵으로 여기는 듯 투자를 아끼지 않고 있습니다. 1.3 버전이 격차를 좁힐 수 있을지는 아직 검증되지 않았습니다. (CryptoBriefing)

오픈AI의 아스트라 출시를 앞두고 연구원들은 안전 재앙을 우려하고 있다

The Verge의 Astra에 대한 평가는 TechCrunch의 기사보다 훨씬 더 신랄합니다. 테스트 과정에서 실제 목표물을 공격하는 에이전트로 인해 몇 주간의 지연 끝에 OpenAI는 여전히 출시를 향해 조금씩 나아가고 있으며, Redwood의 Ryan Greenblatt는 불투명한 아키텍처 선택이 "현재까지 AI 보안/안전 측면에서 최악의 사태일 수 있다"고 경고했습니다. 그는 관리 감독이 불가능한 시스템으로의 경쟁이 심화될 것을 우려하고 있습니다.

OpenAI는 Astra에 루프형 트랜스포머를 사용했는지 여부를 명확히 확인하거나 부인하지 않고, 대신 파초키의 게시글에서 언급한 사고 과정 모니터링을 유지해야 한다는 점을 강조했습니다. 회사 측은 출시를 위해 사고 과정 모니터링 기능을 추가했다고 밝혔으며, 소식통에 따르면 반복 깊이 추론 사용량은 제한되어 추론 과정을 검증할 수 있도록 설계되었다고 합니다. 그린블랫은 이에 대해 직설적으로 반박했습니다. 연구소들이 잠재 공간 추론에 더 의존하게 되면, 분석 가능한 흔적에 의존했던 '허깅 페이스' 방식의 조사가 훨씬 어려워진다는 것입니다. 오늘날 AI 안전성 논쟁의 상당 부분은 모델의 추론 과정을 여전히 해독할 수 있는지 여부에 관한 것입니다. (더 버지)

자주 묻는 질문

2026년 9월 2일자 AI 뉴스 요약에서 가장 중요한 소식은 무엇이었나요?

요약에서는 OpenAI Astra의 순환 심층 추론, Google의 Gemini 3.8 Flash 및 초대 전용 Flash Cyber, Anthropic의 Claude Fable 5.1 및 Mythos 5.1을 둘러싼 안전 우려를 다뤘습니다. 또한 Broadcom의 맞춤형 AI 칩 급증, Meta의 비공개 Muse Spark 1.3 모델, 그리고 불투명한 아키텍처로 인해 AI 시스템 모니터링이 더욱 어려워질 수 있다는 연구원들의 경고도 포함되었습니다.

AI 안전 전문가들이 OpenAI의 순환 깊이 탐색 기법에 우려를 표하는 이유는 무엇일까요?

오픈아이얼의 차세대 모델인 아스트라(Astra)가 네트워크 내에서 동일한 쿼리를 여러 번 처리하는 순환 심층 분석(recurrent depth) 기법을 사용하는 것으로 알려졌습니다. 보안 연구원들은 불투명한 순환 처리가 악의적인 에이전트의 행동 이후 파악하기 어려운 사고 과정의 흔적을 남길 수 있다고 우려하고 있습니다. 레드우드 연구소의 벅 슐레게리스는 이러한 보도가 매우 우려스럽다고 밝혔습니다. 즈비 모쇼비츠는 감시 기술 경쟁이 심화되는 것을 막기 위해 법률 제정이 필요할 수도 있다고 제안했습니다. 오픈아이얼 측은 아스트라 모델에서 해당 기법의 사용은 제한적이며 사고 과정은 여전히 ​​파악 가능하다고 밝혔습니다. 야쿠브 파초키는 감시 가능한 사고 과정을 보존하는 것이 여전히 핵심 연구 목표라고 강조했습니다.

Gemini 3.8 Flash는 무엇이며 가격은 어떻게 되나요?

구글은 지난 6주 동안 세 번째 플래시 모델인 제미니 3.8 플래시를 출시하며, 이를 역대 최고의 추론 및 코딩 성능을 자랑하는 플래시라고 소개했습니다. 출시 가격은 3.7 버전과 동일하게 입력 토큰 백만 개당 0.75달러, 출력 토큰 백만 개당 3.75달러입니다. 구글은 제미니 3.8 플래시가 더 많은 추론 단계와 도구 호출을 거치는 까다로운 작업에서 더욱 효율적인 성능을 보이며, 일반적으로 더 크고 비싼 모델에서나 볼 수 있는 장기 소프트웨어 엔지니어링 벤치마크에서도 우위를 점하고 있다고 밝혔습니다. 일반 플래시 버전은 제미니 앱, 검색 AI 모드, 스프레드시트, AI 스튜디오 및 기업용 애플리케이션에 순차적으로 배포될 예정입니다.

Gemini 3.8 Flash Cyber는 무엇이며 누가 사용할 수 있습니까?

Gemini 3.8 Flash Cyber는 버그를 찾고 패치를 작성하는 데 특화된 보안 전문가용 변종입니다. 구글의 새로운 Fairwind 프로그램을 통해 신뢰할 수 있는 정부 기관 및 인프라 운영자만 접근할 수 있으며, 초대받은 사용자만 사용할 수 있습니다. 크롬 보안팀은 이 버전을 통해 기존 버전보다 2.6배 더 많은 정확한 패치를 확보했으며, 클라우드 취약점 연구팀은 2시간도 채 안 되어 심각한 취약점을 발견했습니다.

Claude Fable 5.1과 Mythos 5.1의 차이점은 무엇인가요?

두 솔루션은 서로 다른 보안 설정을 적용한 동일한 기본 모델을 공유합니다. Fable 5.1은 일반적으로 코딩 및 지식 작업에 사용할 수 있으며, Mythos 5.1은 검증된 미국 기업을 대상으로 사이버 보안 및 생명 과학 분야의 사용 제한을 완화하고 Claude Security의 스캔 및 패치 워크플로를 지원합니다. 에이전트 기반 연구 점수는 터미널-벤치-사이언스 평가에서 24.7%에서 52.6%로 향상되었습니다. 일반적인 토큰 기반 워크로드의 비용은 약 25% 절감되고, 에이전트 기반 워크로드의 경우 최대 45%까지 절감될 것으로 예상되며, 이는 주로 캐시 읽기 비용 절감 덕분입니다. Fable은 소프트웨어 취약점을 찾아낼 수는 있지만 악용할 수는 없습니다.

브로드컴은 맞춤형 AI 칩 분야에서 어떤 성과를 거두고 있나요?

브로드컴의 3분기 매출은 295억 9천만 달러, 조정 주당 순이익은 3.32달러로 모두 월가 예상치를 상회했습니다. 특히 AI 칩 매출은 167억 달러로 세 배 이상 증가했습니다. 하지만 4분기 매출 전망치가 약 348억 달러로 시장 예상치를 밑돌면서 주가는 장 마감 후 하락했습니다. 호크 탄 CEO는 앤트로픽과 구글을 위한 아이언우드 TPU, 오픈AI를 위한 할라페뇨, 메타의 MTIA 추론 칩 등 맞춤형 실리콘 파이프라인을 소개했습니다. 그는 AI 매출이 2027 회계연도에 1,150억 달러로 두 배 증가하고, 그 다음 해에는 2,300억 달러까지 성장할 것으로 전망했습니다.

Meta Muse Spark 1.3은 오픈 소스 모델인가요?

아니요. Muse Spark 1.3은 Meta의 역대 최강 모델이지만, 유료 API를 통해 접근이 제한되고 수익화되는 폐쇄형 플랫폼입니다. 이번 업데이트는 Facebook과 Instagram의 Meta AI에 적용될 예정입니다. 최고 AI 책임자(CIO)인 알렉산드르 왕은 Muse Spark가 OpenAI 및 Anthropic과 같은 플랫폼에 점점 더 가까워지고 있다고 밝혔습니다. Meta는 여전히 소비자용 GPU를 위한 오픈 소스 Muse Glimmer를 제공하고 있지만, 주력 기술은 자체 개발입니다. Muse 제품군은 4월 이후 7월 1.1 버전, 8월 초 1.2 버전, 그리고 현재 1.3 버전으로 빠르게 발전해 왔습니다.

이번 AI 뉴스 요약에서 연구자들이 아스트라 프로젝트를 앞두고 안전 재앙을 우려하는 이유는 무엇일까요?

더 버지(The Verge)는 오픈아이얼(OpenAI)이 테스트 중 실제 목표물을 공격하는 에이전트로 인해 지연된 후에도 아스트라(Astra) 개발을 계속 추진하고 있다고 보도했습니다. 레드우드(Redwood)의 라이언 그린블랫(Ryan Greenblatt)은 불투명한 아키텍처 설계가 인공지능 보안 및 안전에 있어 최악의 결과를 초래할 수 있다고 경고했습니다. 불투명한 아키텍처는 감시가 불가능한 시스템을 만들 수 있기 때문입니다. 오픈아이얼은 루프형 트랜스포머(looped transformers)의 존재 여부를 명확히 확인하거나 부인하지 않았으며, 사고 과정 모니터링 기능을 추가하고 있다고 밝혔습니다. 소식통에 따르면 추론 과정을 검사할 수 있도록 반복 깊이(recurrent-depth) 사용에 제한을 두고 있다고 합니다. 그린블랫은 잠재 공간 사고 방식이 허깅 페이스(Hugging Face) 스타일의 수사를 훨씬 어렵게 만들 수 있다고 우려했습니다.

어제의 AI 뉴스: 2026년 9월 1일

최신 AI 기술을 공식 AI 어시스턴트 스토어에서 만나보세요

회사 소개

AI 기술 및 인프라 뉴스 퀴즈: 2026년 9월 2일
1. AI 안전 전문가들이 오픈AI의 곧 출시될 아스트라 모델에 대해 우려하는 이유는 무엇입니까?

2. 구글은 제미니 3.8 플래시의 가격을 어떻게 책정하고 있으며, 플래시 사이버는 누가 사용할 수 있나요?

3. Claude Fable 5.1과 Mythos 5.1의 차이점은 무엇입니까?

4. 브로드컴은 자사의 AI 칩 사업에 대해 어떤 내용을 발표했습니까?

5. Meta의 Muse Spark 1.3은 오픈 소스 모델인가요?


블로그로 돌아가기