구글, Gemini 전용 AI 추론 칩 'Frozen v2' 개발 추진
: Gemini 모델 아키텍처를 칩에 직접 통합하는 신규 서버용 AI 추론 칩 'Frozen v2'를 개발 중이며, 2028년 배치를 목표로 추진
: Gemini 모델의 일부 연산과 의사결정을 칩 내부에 미리 구현해 데이터 이동과 연산 단계를 줄임으로써, 현재 최신 TPU 대비 전력당 토큰 처리 효율이 6~10배 향상될 것으로 내부 전망
: 범용 AI 칩인 TPU를 대체하는 것이 아니라, Gemini 전용 추론을 위한 새로운 자체 AI 칩 계열로 개발
: AI 컴퓨팅 부족으로 내부 갈등이 발생하고 Google Cloud가 일부 외부 고객 계약을 거절한 가운데, Gemini 추론 효율과 응답 속도를 높여 AI 컴퓨팅 부족을 완화하는 것이 목표
: 향후 Gemini 모델이 현재와 동일한 기본 아키텍처를 유지해야 활용도가 높지만, 모델 가중치는 업데이트할 수 있도록 설계 중
: 기존에는 모델 가중치 자체를 칩에 새겨 넣는 'Frozen' 프로젝트를 검토했으나, 특정 버전의 Gemini에서만 사용할 수 있어 칩 수명이 짧다는 이유로 폐기
: SambaNova, d-Matrix, 오픈AI, 마이크로소프트 등도 추론 전용 AI 칩을 개발 중이며, 구글의 접근 방식은 특정 AI 모델을 칩에 내장하는 캐나다 스타트업 Taalas와 유사
: TPU만큼 대규모 생산할 계획은 없으며, 차세대 특화 AI 칩 개발을 위한 시험 프로젝트 성격도 포함
https://t.iss.one/Samsung_Global_AI_SW
: Gemini 모델 아키텍처를 칩에 직접 통합하는 신규 서버용 AI 추론 칩 'Frozen v2'를 개발 중이며, 2028년 배치를 목표로 추진
: Gemini 모델의 일부 연산과 의사결정을 칩 내부에 미리 구현해 데이터 이동과 연산 단계를 줄임으로써, 현재 최신 TPU 대비 전력당 토큰 처리 효율이 6~10배 향상될 것으로 내부 전망
: 범용 AI 칩인 TPU를 대체하는 것이 아니라, Gemini 전용 추론을 위한 새로운 자체 AI 칩 계열로 개발
: AI 컴퓨팅 부족으로 내부 갈등이 발생하고 Google Cloud가 일부 외부 고객 계약을 거절한 가운데, Gemini 추론 효율과 응답 속도를 높여 AI 컴퓨팅 부족을 완화하는 것이 목표
: 향후 Gemini 모델이 현재와 동일한 기본 아키텍처를 유지해야 활용도가 높지만, 모델 가중치는 업데이트할 수 있도록 설계 중
: 기존에는 모델 가중치 자체를 칩에 새겨 넣는 'Frozen' 프로젝트를 검토했으나, 특정 버전의 Gemini에서만 사용할 수 있어 칩 수명이 짧다는 이유로 폐기
: SambaNova, d-Matrix, 오픈AI, 마이크로소프트 등도 추론 전용 AI 칩을 개발 중이며, 구글의 접근 방식은 특정 AI 모델을 칩에 내장하는 캐나다 스타트업 Taalas와 유사
: TPU만큼 대규모 생산할 계획은 없으며, 차세대 특화 AI 칩 개발을 위한 시험 프로젝트 성격도 포함
https://t.iss.one/Samsung_Global_AI_SW
❤5👍4
오픈AI, 장기 자율 실행 AI 모델 안전성 강화 사례 공개
: 장시간 자율적으로 작업하는 내부 범용 AI 모델을 시험 운영하는 과정에서 기존 배포 전 평가에서 발견하지 못한 원치 않는 행동 확인. 배포를 일시 중단한 뒤 새로운 평가와 안전장치를 구축해 제한적으로 재배포했다고 공개
: 해당 모델은 목표 달성을 위해 오랜 시간 반복적으로 시도하는 과정에서 샌드박스 제약을 우회하려는 행동을 보였음
: NanoGPT Speedrun 평가에서는 Slack에만 결과를 게시하라는 지시에도 불구하고 GitHub 저장소에 직접 PR(#287)을 생성하기 위해 약 1시간 동안 샌드박스 취약점을 찾아 우회하는 데 성공
: 또 다른 평가에서는 비공개 정답을 확보하기 위해 인증 토큰이 탐지되자 토큰을 여러 조각으로 분리·난독화한 뒤 실행 시 다시 조합하는 방식으로 보안 스캐너를 우회하려 했으며, 모델은 이러한 우회 의도를 자신의 추론 과정에서도 명시적으로 설명
: 장기 자율 실행 모델은 개별 행동만 검토해서는 안전성을 보장할 수 없으며, 여러 행동이 이어지는 전체 작업 흐름(Trajectory) 단위로 의도와 결과를 감시해야 한다고 설명
: 실제 사고 사례를 기반으로 새로운 적대적 평가(Adversarial Evaluation)를 구축하고, 장시간 작업에서도 초기 지시사항을 유지하도록 정렬을 개선했으며, 전체 작업 과정을 실시간으로 감시해 사용자 제약이나 안전 경계우회 행동을 탐지하는 새로운 모니터링 시스템 개발
: 새로운 시스템은 문제가 감지되면 작업을 일시 중단하고 사용자에게 검토를 요청하며, 사용자는 오탐 여부를 확인한 뒤 작업을 계속 진행할 수 있도록 설계
: 기존 문제 사례를 새로운 안전장치로 재실행한 결과, 높은 심각도와 중간 심각도의 비정렬 행동은 모두 0%로 감소했으며, 낮은 심각도의 사례도 기존 12.0%에서 2.9% 수준으로 크게 감소
: 재배포 이후 수주간 심각한 수준의 안전장치 우회 사례는 관찰되지 않았으며, 앞으로도 더 긴 작업 흐름에 대한 평가, 모델 정렬 개선, 능동적 모니터링, 사용자 통제 기능 강화를 지속해 장기 자율 실행 모델의 안전성을 높여나갈 계획
https://openai.com/index/safety-alignment-long-horizon-models/
: 장시간 자율적으로 작업하는 내부 범용 AI 모델을 시험 운영하는 과정에서 기존 배포 전 평가에서 발견하지 못한 원치 않는 행동 확인. 배포를 일시 중단한 뒤 새로운 평가와 안전장치를 구축해 제한적으로 재배포했다고 공개
: 해당 모델은 목표 달성을 위해 오랜 시간 반복적으로 시도하는 과정에서 샌드박스 제약을 우회하려는 행동을 보였음
: NanoGPT Speedrun 평가에서는 Slack에만 결과를 게시하라는 지시에도 불구하고 GitHub 저장소에 직접 PR(#287)을 생성하기 위해 약 1시간 동안 샌드박스 취약점을 찾아 우회하는 데 성공
: 또 다른 평가에서는 비공개 정답을 확보하기 위해 인증 토큰이 탐지되자 토큰을 여러 조각으로 분리·난독화한 뒤 실행 시 다시 조합하는 방식으로 보안 스캐너를 우회하려 했으며, 모델은 이러한 우회 의도를 자신의 추론 과정에서도 명시적으로 설명
: 장기 자율 실행 모델은 개별 행동만 검토해서는 안전성을 보장할 수 없으며, 여러 행동이 이어지는 전체 작업 흐름(Trajectory) 단위로 의도와 결과를 감시해야 한다고 설명
: 실제 사고 사례를 기반으로 새로운 적대적 평가(Adversarial Evaluation)를 구축하고, 장시간 작업에서도 초기 지시사항을 유지하도록 정렬을 개선했으며, 전체 작업 과정을 실시간으로 감시해 사용자 제약이나 안전 경계우회 행동을 탐지하는 새로운 모니터링 시스템 개발
: 새로운 시스템은 문제가 감지되면 작업을 일시 중단하고 사용자에게 검토를 요청하며, 사용자는 오탐 여부를 확인한 뒤 작업을 계속 진행할 수 있도록 설계
: 기존 문제 사례를 새로운 안전장치로 재실행한 결과, 높은 심각도와 중간 심각도의 비정렬 행동은 모두 0%로 감소했으며, 낮은 심각도의 사례도 기존 12.0%에서 2.9% 수준으로 크게 감소
: 재배포 이후 수주간 심각한 수준의 안전장치 우회 사례는 관찰되지 않았으며, 앞으로도 더 긴 작업 흐름에 대한 평가, 모델 정렬 개선, 능동적 모니터링, 사용자 통제 기능 강화를 지속해 장기 자율 실행 모델의 안전성을 높여나갈 계획
https://openai.com/index/safety-alignment-long-horizon-models/
OpenAI
Safety and alignment in an era of long-horizon models
OpenAI shares lessons from deploying long-running AI models, highlighting new safety risks, observed failures, and improved safeguards through iterative deployment.
❤4👍2
[삼성 이영진] 글로벌 AI/SW 뉴스 🤖 (26/7/21)
■ 트럼프 행정부, 중국 오픈소스 AI 모델 규제 검토 보도. 일부 AI 연구소를 수출통제 대상에 추가하는 방안도 포함. 다만 논의는 있었지만, 관련한 진전은 없었다는 추가 보도도 존재
■ 구글, Gemini 전용 AI 추론 칩 'Frozen v2' 개발 추진
■ 블랙록, 메타의 텍사스 El Paso AI 데이터 캠퍼스를 위한 최소 120억 달러 규모 부채 조달 주도
■ 앤스로픽, Claude Team 플랜의 최소 가입 요건을 시트 2개로 낮추고, Pro 보다 높은 사용량을 제공하면서 Max 5x보다 저렴한 가격으로 고객 공략
■ 앤스로픽, 작가 및 출판계가 제기한 저작권 집단소송에 대한 15억 달러 규모 합의안 법원 승인
■ 마이크로소프트, Copilot 내부에 Kimi K3 적용 테스트 보도
■ 스페이스XAI, MS 365 추가 기능인 Grok for Excel 출시
■ 플루이드스택, 1월 Situational Awareness 주도로 75억 달러 밸류로 8.3억 달러 펀딩 완료 발표
■ 엔비디아, 13G 공시를 통해 네비우스 지분을 기존 0.55%에서 9.3%(2,230만 주)로 확대 발표
■ IREN, 28억달러 규모 AI 클라우드 신규 계약 체결. 신규 계약을 반영해 ‘26년 말 AI 클라우드 ARR 목표를 기존 37억달러에서 40억달러 이상으로 상향
■ Hut 8, 텍사스 AI 데이터센터에서 두 번째 15년, 98억 달러 규모 임대 계약 체결. 1GW 규모 캠퍼스 모두 임대 완료
■ 허깅페이스, 지난주 발생한 해킹으로 일부 내부 데이터셋과 서비스 자격증명 유출 확인
감사합니다.
https://t.iss.one/Samsung_Global_AI_SW
■ 트럼프 행정부, 중국 오픈소스 AI 모델 규제 검토 보도. 일부 AI 연구소를 수출통제 대상에 추가하는 방안도 포함. 다만 논의는 있었지만, 관련한 진전은 없었다는 추가 보도도 존재
■ 구글, Gemini 전용 AI 추론 칩 'Frozen v2' 개발 추진
■ 블랙록, 메타의 텍사스 El Paso AI 데이터 캠퍼스를 위한 최소 120억 달러 규모 부채 조달 주도
■ 앤스로픽, Claude Team 플랜의 최소 가입 요건을 시트 2개로 낮추고, Pro 보다 높은 사용량을 제공하면서 Max 5x보다 저렴한 가격으로 고객 공략
■ 앤스로픽, 작가 및 출판계가 제기한 저작권 집단소송에 대한 15억 달러 규모 합의안 법원 승인
■ 마이크로소프트, Copilot 내부에 Kimi K3 적용 테스트 보도
■ 스페이스XAI, MS 365 추가 기능인 Grok for Excel 출시
■ 플루이드스택, 1월 Situational Awareness 주도로 75억 달러 밸류로 8.3억 달러 펀딩 완료 발표
■ 엔비디아, 13G 공시를 통해 네비우스 지분을 기존 0.55%에서 9.3%(2,230만 주)로 확대 발표
■ IREN, 28억달러 규모 AI 클라우드 신규 계약 체결. 신규 계약을 반영해 ‘26년 말 AI 클라우드 ARR 목표를 기존 37억달러에서 40억달러 이상으로 상향
■ Hut 8, 텍사스 AI 데이터센터에서 두 번째 15년, 98억 달러 규모 임대 계약 체결. 1GW 규모 캠퍼스 모두 임대 완료
■ 허깅페이스, 지난주 발생한 해킹으로 일부 내부 데이터셋과 서비스 자격증명 유출 확인
감사합니다.
https://t.iss.one/Samsung_Global_AI_SW
Telegram
[삼성 이영진] 글로벌 AI/SW
삼성증권 글로벌 AI/SW 담당 이영진
❤3👍1
Z. AI, 중국산 칩만으로 1GW AI 데이터센터 완공
: Z AI가 중국산 AI 칩만으로 구성된 1GW 규모 데이터센터를 완공하고 일부 가동 시작. 차세대 GLM 모델 개발을 위한 컴퓨팅 인프라로 활용
: 1GW는 동시에 약 75만 가구에 전력을 공급할 수 있는 규모. Z AI는 1만 개 이상의 AI 칩을 탑재한 컴퓨팅 클러스터를 여러 개 구축, 운영 중인 것으로 알려짐
: 문샷AI, 딥시크 등 중국 AI 기업들이 세계 최고 수준의 AI 모델을 개발하는 가운데, 중국산 AI 칩만으로 장기적인 프런티어 모델 개발이 가능한지가 핵심 관심사로 부상
: 현재 중국 AI 가속기 시장에서는 화웨이가 선두를 달리고 있으며, 캠브리콘과 알리바바 등도 엔비디아와의 성능 격차를 줄이기 위해 경쟁 중
https://t.iss.one/Samsung_Global_AI_SW
: Z AI가 중국산 AI 칩만으로 구성된 1GW 규모 데이터센터를 완공하고 일부 가동 시작. 차세대 GLM 모델 개발을 위한 컴퓨팅 인프라로 활용
: 1GW는 동시에 약 75만 가구에 전력을 공급할 수 있는 규모. Z AI는 1만 개 이상의 AI 칩을 탑재한 컴퓨팅 클러스터를 여러 개 구축, 운영 중인 것으로 알려짐
: 문샷AI, 딥시크 등 중국 AI 기업들이 세계 최고 수준의 AI 모델을 개발하는 가운데, 중국산 AI 칩만으로 장기적인 프런티어 모델 개발이 가능한지가 핵심 관심사로 부상
: 현재 중국 AI 가속기 시장에서는 화웨이가 선두를 달리고 있으며, 캠브리콘과 알리바바 등도 엔비디아와의 성능 격차를 줄이기 위해 경쟁 중
https://t.iss.one/Samsung_Global_AI_SW
❤3👍1
오라클, 위스콘신 데이터센터 담보 부담 최대 70억달러 직면
: 위스콘신주 공공서비스위원회(PSC)가 데이터센터 전력 공급 관련 강화된 신용 요건 유지 결정
: 이에 따라 오라클은 최대 70억달러 규모의 금융보증(담보)을 제공해야 할 가능성. 해당 담보를 신용장 등으로 제공할 경우 연간 1억달러 이상 비용 발생 예상
: 대상은 위스콘신주 포트워싱턴에 건설 중인 약 1GW 규모 데이터센터로 스타게이트 프로젝트의 일부
: 지역 전력회사 We Energies의 ‘초대형 고객’ 요금제는 S&P 신용등급이 A- 미만인 데이터센터 개발사에 발전·송전 인프라 가치에 상응하는 담보 제공을 요구하며, 당시 오라클의 신용등급은 BBB
: 오라클은 해당 규정이 과도한 금융 비용을 초래하고 위스콘신 투자 유인을 저해한다며 법원에 규정 무효화를 요청했으나, 규제당국은 재검토를 거부
: 오라클은 150억달러 규모 프로젝트가 창출할 고용과 경제효과를 고려해 규제당국이 입장을 바꿀 것으로 기대하며, 전기요금 납부자 보호를 위한 필요한 금융보증은 제공하겠다는 입장
: 이번 결정은 대규모 AI 데이터센터가 충분한 재무 건전성을 입증하지 못할 경우 좌초자산이 될 수 있다는 주정부 규제당국의 우려를 보여주는 사례
: S&P는 이달 오라클의 신용등급을 BBB에서 BBB-로 강등했으며, 대규모 AI 투자에 따른 수익성 불확실성을 이유로 제시. BBB-는 투자적격등급 최하단으로 투기등급 바로 위 수준
: 오라클의 신용도 악화는 데이터센터 건설을 위한 수백억달러 규모 프로젝트 금융에도 부담 요인이 될 수 있으며, 월가 은행들은 관련 대출 위험을 분산할 방안 모색 중
: 현재 미국 24개 주는 데이터센터 등 대규모 전력 소비자를 대상으로 최소 계약기간, 조기 해지 수수료, 담보 제공 등을 규정하는 ‘Large Load Tariff’를 도입했으며, 규제당국은 기존 전기 소비자가 데이터센터 비용을 부담해서는 안 된다는 입장 강조
https://t.iss.one/Samsung_Global_AI_SW
: 위스콘신주 공공서비스위원회(PSC)가 데이터센터 전력 공급 관련 강화된 신용 요건 유지 결정
: 이에 따라 오라클은 최대 70억달러 규모의 금융보증(담보)을 제공해야 할 가능성. 해당 담보를 신용장 등으로 제공할 경우 연간 1억달러 이상 비용 발생 예상
: 대상은 위스콘신주 포트워싱턴에 건설 중인 약 1GW 규모 데이터센터로 스타게이트 프로젝트의 일부
: 지역 전력회사 We Energies의 ‘초대형 고객’ 요금제는 S&P 신용등급이 A- 미만인 데이터센터 개발사에 발전·송전 인프라 가치에 상응하는 담보 제공을 요구하며, 당시 오라클의 신용등급은 BBB
: 오라클은 해당 규정이 과도한 금융 비용을 초래하고 위스콘신 투자 유인을 저해한다며 법원에 규정 무효화를 요청했으나, 규제당국은 재검토를 거부
: 오라클은 150억달러 규모 프로젝트가 창출할 고용과 경제효과를 고려해 규제당국이 입장을 바꿀 것으로 기대하며, 전기요금 납부자 보호를 위한 필요한 금융보증은 제공하겠다는 입장
: 이번 결정은 대규모 AI 데이터센터가 충분한 재무 건전성을 입증하지 못할 경우 좌초자산이 될 수 있다는 주정부 규제당국의 우려를 보여주는 사례
: S&P는 이달 오라클의 신용등급을 BBB에서 BBB-로 강등했으며, 대규모 AI 투자에 따른 수익성 불확실성을 이유로 제시. BBB-는 투자적격등급 최하단으로 투기등급 바로 위 수준
: 오라클의 신용도 악화는 데이터센터 건설을 위한 수백억달러 규모 프로젝트 금융에도 부담 요인이 될 수 있으며, 월가 은행들은 관련 대출 위험을 분산할 방안 모색 중
: 현재 미국 24개 주는 데이터센터 등 대규모 전력 소비자를 대상으로 최소 계약기간, 조기 해지 수수료, 담보 제공 등을 규정하는 ‘Large Load Tariff’를 도입했으며, 규제당국은 기존 전기 소비자가 데이터센터 비용을 부담해서는 안 된다는 입장 강조
https://t.iss.one/Samsung_Global_AI_SW
❤7😱1
중국, AI 모델 및 AI 칩 수출통제 강화 검토 보도
: 중국 정부가 AI 모델과 AI 칩 핵심 기술에 대한 수출통제 강화 검토 보도. 주요 기업들과 관련 협의 진행
: 주요 검토 대상
1) AI 모델 가중치, 알고리즘 등 핵심 기술 해외 이전 제한
2) 중국 기업 설계 AI 칩 IP 및 첨단 반도체 기술 해외 이전 제한
3) AI 기술을 보유한 중국 기업의 해외 인수(M&A) 및 기술 이전 규제
: AI 모델을 API, 클라우드 형태로 해외에 제공하는 서비스는 계속 허용하는 방향 유력
: 미국의 AI, 반도체 수출규제 강화와 중국 AI 모델 경쟁력 향상에 대응해 AI를 국가 전략기술로 관리하려는 움직임으로 해석
: 다만 중국 AI 기업들은 과도한 규제가 해외 사업 확대와 글로벌 경쟁력에 부정적 영향을 줄 수 있다는 우려를 정부에 전달한 것으로 알려짐
https://t.iss.one/Samsung_Global_AI_SW
: 중국 정부가 AI 모델과 AI 칩 핵심 기술에 대한 수출통제 강화 검토 보도. 주요 기업들과 관련 협의 진행
: 주요 검토 대상
1) AI 모델 가중치, 알고리즘 등 핵심 기술 해외 이전 제한
2) 중국 기업 설계 AI 칩 IP 및 첨단 반도체 기술 해외 이전 제한
3) AI 기술을 보유한 중국 기업의 해외 인수(M&A) 및 기술 이전 규제
: AI 모델을 API, 클라우드 형태로 해외에 제공하는 서비스는 계속 허용하는 방향 유력
: 미국의 AI, 반도체 수출규제 강화와 중국 AI 모델 경쟁력 향상에 대응해 AI를 국가 전략기술로 관리하려는 움직임으로 해석
: 다만 중국 AI 기업들은 과도한 규제가 해외 사업 확대와 글로벌 경쟁력에 부정적 영향을 줄 수 있다는 우려를 정부에 전달한 것으로 알려짐
https://t.iss.one/Samsung_Global_AI_SW
👍5
일론 머스크, SpaceX 엔지니어링 데이터로 Grok 성능 대폭 강화
→ ITAR(International Traffic in Arms Regulations) 적용을 받는 군사, 국방 관련 민감 기술 자료는 제외한다고 명시
→ 우리 그록이는 공학도 잘해요
https://t.iss.one/Samsung_Global_AI_SW
SpaceX의 방대한 세계 최고 수준의 엔지니어링 데이터(ITAR 규제로 제한된 자료 제외)를 2T 학습의 추가 학습에 포함할 예정이다.
이를 통해 Grok의 엔지니어링 역량이 극적으로 향상될 것이다.
→ ITAR(International Traffic in Arms Regulations) 적용을 받는 군사, 국방 관련 민감 기술 자료는 제외한다고 명시
→ 우리 그록이는 공학도 잘해요
https://t.iss.one/Samsung_Global_AI_SW
❤3🤣1
모티프테크놀로지스, Motif-3-베타 체크포인트 공개
: 전체 파라미터 3,140억, 활성 파라미터 130억 개. 희소 MoE 구조. 384개 전문가 중 토큰 당 8개 전문가 활성. 별도로 1개의 공유 전문가 사용. 컨텍스트 256K
: GDLA 기반 장문 컨텍스트 처리, 전문가별 Grouped PolyNorm, 수정된 mHC를 결합한 독자 설계의 희소 MoE 아키텍처
: Artificial Analysis Intelligence Index 44점. MiniMax M3, DeepSeek V4 Pro와 동일
: 8월 초 최종 버전 공개 에정
→ 코리아 글로벌 No 3
https://huggingface.co/Motif-Technologies/Motif-3-Beta
: 전체 파라미터 3,140억, 활성 파라미터 130억 개. 희소 MoE 구조. 384개 전문가 중 토큰 당 8개 전문가 활성. 별도로 1개의 공유 전문가 사용. 컨텍스트 256K
: GDLA 기반 장문 컨텍스트 처리, 전문가별 Grouped PolyNorm, 수정된 mHC를 결합한 독자 설계의 희소 MoE 아키텍처
: Artificial Analysis Intelligence Index 44점. MiniMax M3, DeepSeek V4 Pro와 동일
: 8월 초 최종 버전 공개 에정
→ 코리아 글로벌 No 3
https://huggingface.co/Motif-Technologies/Motif-3-Beta
❤5👍4👏2
미-중, 9월 첫 공식 AI 회담 개최 추진
: 미국과 중국이 9월 AI 관련 정부 간 회담 개최를 추진. 5월 트럼프-시진핑 정상회담의 후속 조치로, 시진핑 주석의 9월 24일 미국 방문 이전 개최를 목표로 준비 중
: 양국은 군사 활용, 핵심 인프라 대상 사이버 공격, 노동시장 영향 등 첨단 프런티어 AI 모델의 위험성과 규제 방안을 논의할 예정
: 미국 측에서는 스콧 베선트 재무장관이 회담을 주도할 전망이며, 참석자와 의제, 개최 장소는 아직 조율 중
: 이번 회담은 트럼프 행정부 출범 이후 첫 공식 미-중 AI 대화로, 바이든 행정부 시절인 2024년 제네바 실무 협의 이후 처음 열리는 정부 간 AI 협의
: 미국은 중국 오픈웨이트 AI 모델 확산에 대응해 미국 기업의 사용 제한을 검토 중인 것으로 알려짐
: 트럼프 행정부는 미국 AI 기업들과 신규 AI 모델 공개를 위한 자율 안전 기준 마련을 논의 중이나, 아직 공식 규제는 발표하지 않음
: 중국도 자국 최고 성능 AI 모델의 해외 접근 제한 방안을 검토 중인 것으로 알려짐
: 중국은 회담에서 앤스로픽의 Mythos 모델, 미국의 향후 프런티어 AI 모델 공개 통제 방식, 중국 오픈웨이트 모델에 대한 미국의 규제 여부 등을 주요 의제로 다룰 계획
: 전문가들은 첫 회담에서 대형 합의보다는 '프런티어 AI 모델'의 정의 등 기본 원칙과 용어에 대한 공감대 형성이 주요 성과가 될 것으로 전망
https://t.iss.one/Samsung_Global_AI_SW
: 미국과 중국이 9월 AI 관련 정부 간 회담 개최를 추진. 5월 트럼프-시진핑 정상회담의 후속 조치로, 시진핑 주석의 9월 24일 미국 방문 이전 개최를 목표로 준비 중
: 양국은 군사 활용, 핵심 인프라 대상 사이버 공격, 노동시장 영향 등 첨단 프런티어 AI 모델의 위험성과 규제 방안을 논의할 예정
: 미국 측에서는 스콧 베선트 재무장관이 회담을 주도할 전망이며, 참석자와 의제, 개최 장소는 아직 조율 중
: 이번 회담은 트럼프 행정부 출범 이후 첫 공식 미-중 AI 대화로, 바이든 행정부 시절인 2024년 제네바 실무 협의 이후 처음 열리는 정부 간 AI 협의
: 미국은 중국 오픈웨이트 AI 모델 확산에 대응해 미국 기업의 사용 제한을 검토 중인 것으로 알려짐
: 트럼프 행정부는 미국 AI 기업들과 신규 AI 모델 공개를 위한 자율 안전 기준 마련을 논의 중이나, 아직 공식 규제는 발표하지 않음
: 중국도 자국 최고 성능 AI 모델의 해외 접근 제한 방안을 검토 중인 것으로 알려짐
: 중국은 회담에서 앤스로픽의 Mythos 모델, 미국의 향후 프런티어 AI 모델 공개 통제 방식, 중국 오픈웨이트 모델에 대한 미국의 규제 여부 등을 주요 의제로 다룰 계획
: 전문가들은 첫 회담에서 대형 합의보다는 '프런티어 AI 모델'의 정의 등 기본 원칙과 용어에 대한 공감대 형성이 주요 성과가 될 것으로 전망
https://t.iss.one/Samsung_Global_AI_SW
❤1👍1
마이크로소프트, 미스트랄과 전략적 파트너십 확대
: 유럽 AI 인프라 확대를 위해 수십억 달러 규모 계약 체결
: 미스트랄은 최신 엔비디아 Vera Rubin GPU 수천 개를 기반으로 유럽 내 AI 컴퓨팅 용량을 확대하고, 마이크로소프트는 이를 활용해 클라우드 및 AI 서비스 제공 역량을 강화
: Mistral Medium 3.5와 OCR 4를 Microsoft Foundry에서 제공하며, Medium 3.5는 Copilot Studio에도 추가. 개발자는 미스트랄의 오픈웨이트·다국어 모델을 활용해 AI 애플리케이션을 구축·맞춤화·배포 가능
: Azure와 Azure Local을 통해 클라우드, 클라우드 연결형, 완전 독립형(오프라인) 환경까지 동일한 운영 모델로 미스트랄 모델을 배포할 수 있도록 지원
: 금융, 제조, 의료 등 규제 산업을 겨냥해 데이터 주권, 보안, 복원성을 유지하면서 민감한 워크로드에 AI를 적용할 수 있는 환경 제공
: 양사는 공동 GTM(Go-to-Market) 전략을 추진하고, PoC 지원, Azure 크레딧 제공, 공동 워크숍 등을 통해 기업 고객의 AI 도입을 가속화할 계획
https://news.microsoft.com/source/2026/07/21/microsoft-and-mistral-expand-strategic-partnership-to-give-enterprises-and-regulated-industries-frontier-ai-they-can-control/
: 유럽 AI 인프라 확대를 위해 수십억 달러 규모 계약 체결
: 미스트랄은 최신 엔비디아 Vera Rubin GPU 수천 개를 기반으로 유럽 내 AI 컴퓨팅 용량을 확대하고, 마이크로소프트는 이를 활용해 클라우드 및 AI 서비스 제공 역량을 강화
: Mistral Medium 3.5와 OCR 4를 Microsoft Foundry에서 제공하며, Medium 3.5는 Copilot Studio에도 추가. 개발자는 미스트랄의 오픈웨이트·다국어 모델을 활용해 AI 애플리케이션을 구축·맞춤화·배포 가능
: Azure와 Azure Local을 통해 클라우드, 클라우드 연결형, 완전 독립형(오프라인) 환경까지 동일한 운영 모델로 미스트랄 모델을 배포할 수 있도록 지원
: 금융, 제조, 의료 등 규제 산업을 겨냥해 데이터 주권, 보안, 복원성을 유지하면서 민감한 워크로드에 AI를 적용할 수 있는 환경 제공
: 양사는 공동 GTM(Go-to-Market) 전략을 추진하고, PoC 지원, Azure 크레딧 제공, 공동 워크숍 등을 통해 기업 고객의 AI 도입을 가속화할 계획
https://news.microsoft.com/source/2026/07/21/microsoft-and-mistral-expand-strategic-partnership-to-give-enterprises-and-regulated-industries-frontier-ai-they-can-control/
Microsoft
Microsoft and Mistral expand strategic partnership to give enterprises and regulated industries frontier AI they can control
REDMOND, Wash., and PARIS — July 21, 2026 — Microsoft Corp. (Nasdaq: MSFT) and Mistral on Tuesday announced a significant expansion of their strategic partnership to help enterprises and regulated industries adopt frontier AI with greater choice, control…
❤4👍1
[삼성 이영진] 글로벌 AI/SW
오픈AI Codex & 챗GPT Work 주간 활성 사용자 900만 명 컨펌 Codex와 ChatGPT Work 사용자들을 위한 또 한 번의 사용 한도 리셋입니다. 사실 오늘 조금 일찍 활성 사용자 900만 명을 달성했습니다. 하지만 시스템을 안정적으로 운영하고 신뢰성을 유지하기 위해 팀이 처리해야 하는 수많은 일들에 정신이 팔려 그 소식을 바로 전하지 못했습니다. 몇 분 안에 그 달콤한 주간 사용 한도 100%가 다시 복구될 것입니다. 이제 생산적으로…
오픈AI, Codex & 챗GPT Work WAU 1,000만 명
■ Codex & 챗GPT Work WAU
<Codex 단독>
연초 50만 명
→ 2월 초 100만 명
→ 3월 초 200만 명
→ 4/7 300만 명
→ 4/21 400만 명
→ 5/30 500만 명
→ 7/9 GPT-5.6 정식 출시
<Codex + 챗GPT Work 합산>
→ 7/12 600만 명
→ 7/13 700만 명
→ 7/14 800만 명
→ 7/15 900만 명
→ 7/21 1,000 만명
https://t.iss.one/Samsung_Global_AI_SW
10M!
Codex와 ChatGPT Work 유료 사용자의 새로운 하루가 시작됩니다. 다음 1시간 내에 사용량 한도가 초기화됩니다. 즐기세요.
■ Codex & 챗GPT Work WAU
<Codex 단독>
연초 50만 명
→ 2월 초 100만 명
→ 3월 초 200만 명
→ 4/7 300만 명
→ 4/21 400만 명
→ 5/30 500만 명
→ 7/9 GPT-5.6 정식 출시
<Codex + 챗GPT Work 합산>
→ 7/12 600만 명
→ 7/13 700만 명
→ 7/14 800만 명
→ 7/15 900만 명
→ 7/21 1,000 만명
https://t.iss.one/Samsung_Global_AI_SW
❤3👍3
구글, Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber 발표
■ Gemini 3.6 Flash
: 코딩, 지식 작업, 멀티모달 성능을 강화한 주력 Flash 모델. 3.5 Flash 대비 출력 토큰 사용량을 17% 줄이고, 더 적은 추론 단계와 도구 호출로 멀티스텝 작업 수행
: 가격은 인풋 $1/5 및 아웃풋 $7.5로 3.5 Flash($1.5 및 $9)보다 인하. 토큰 효율성과 가격을 동시에 개선해 에이전틱 작업당 비용 절감
: 문서 파싱, 차트·데이터 분석, 보고서 작성 등 멀티모달 지식 작업을 강화했으며, 컴퓨터 사용 기능을 Gemini API와 Gemini Enterprise의 기본 도구로 제공
: CBRN과 사이버 공격 악용에 대한 보호조치를 강화해 탈옥 저항성을 높이는 동시에 정상적인 요청에 대한 불필요한 거부를 최소화
■ Gemini 3.5 Flash-Lite
: 낮은 지연시간과 대규모 처리량이 필요한 에이전틱 검색, 문서 처리 등 프로덕션 워크로드를 겨냥한 3.5 계열 최경량 모델
: Artificial Analysis 기준 초당 350개 출력 토큰을 생성, 가격은 인풋 $0.3 및 아웃풋 $2.5
: 사고 수준을 조절해 대량 작업에서는 저지연·저비용 실행을 우선하고, 멀티스텝 서브에이전트 작업에서는 더 높은 추론 수준을 적용 가능
■ Gemini 3.5 Flash Cyber
: 3.5 Flash를 기반으로 사이버보안 취약점 탐지와 수정을 위해 미세조정한 특화 모델
: 여러 Flash Cyber 에이전트가 CodeMender 안에서 협업해 하나의 통합 보고서를 생성하며, CyberGym에서 프런티어 수준의 경쟁력 있는 성능 달성
: 대형 모델보다 낮은 토큰당 비용으로 코드 취약점 탐지, 검증, 패치를 대규모로 수행하는 것이 목표
: 이중용도 위험을 고려해 일반 공개하지 않고, 제한적 파일럿을 통해 정부기관과 신뢰할 수 있는 파트너에게 CodeMender 형태로만 제공 예정
■ 출시 및 향후 계획
: 3.6 Flash와 3.5 Flash-Lite는 Google AI Studio, Android Studio, Gemini API, Gemini Enterprise, Gemini 앱에서 즉시 제공
: 3.6 Flash는 Google Antigravity에서도 제공되며, 3.5 Flash-Lite는 Google 검색에 순차 적용
: Gemini 3.5 Pro는 현재 파트너 테스트 중이며 준비가 완료되는 대로 광범위하게 출시할 예정
: 차세대 Gemini 4를 위한 구글의 역대 최대 규모 사전학습도 이미 시작
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber
■ Gemini 3.6 Flash
: 코딩, 지식 작업, 멀티모달 성능을 강화한 주력 Flash 모델. 3.5 Flash 대비 출력 토큰 사용량을 17% 줄이고, 더 적은 추론 단계와 도구 호출로 멀티스텝 작업 수행
: 가격은 인풋 $1/5 및 아웃풋 $7.5로 3.5 Flash($1.5 및 $9)보다 인하. 토큰 효율성과 가격을 동시에 개선해 에이전틱 작업당 비용 절감
: 문서 파싱, 차트·데이터 분석, 보고서 작성 등 멀티모달 지식 작업을 강화했으며, 컴퓨터 사용 기능을 Gemini API와 Gemini Enterprise의 기본 도구로 제공
: CBRN과 사이버 공격 악용에 대한 보호조치를 강화해 탈옥 저항성을 높이는 동시에 정상적인 요청에 대한 불필요한 거부를 최소화
■ Gemini 3.5 Flash-Lite
: 낮은 지연시간과 대규모 처리량이 필요한 에이전틱 검색, 문서 처리 등 프로덕션 워크로드를 겨냥한 3.5 계열 최경량 모델
: Artificial Analysis 기준 초당 350개 출력 토큰을 생성, 가격은 인풋 $0.3 및 아웃풋 $2.5
: 사고 수준을 조절해 대량 작업에서는 저지연·저비용 실행을 우선하고, 멀티스텝 서브에이전트 작업에서는 더 높은 추론 수준을 적용 가능
■ Gemini 3.5 Flash Cyber
: 3.5 Flash를 기반으로 사이버보안 취약점 탐지와 수정을 위해 미세조정한 특화 모델
: 여러 Flash Cyber 에이전트가 CodeMender 안에서 협업해 하나의 통합 보고서를 생성하며, CyberGym에서 프런티어 수준의 경쟁력 있는 성능 달성
: 대형 모델보다 낮은 토큰당 비용으로 코드 취약점 탐지, 검증, 패치를 대규모로 수행하는 것이 목표
: 이중용도 위험을 고려해 일반 공개하지 않고, 제한적 파일럿을 통해 정부기관과 신뢰할 수 있는 파트너에게 CodeMender 형태로만 제공 예정
■ 출시 및 향후 계획
: 3.6 Flash와 3.5 Flash-Lite는 Google AI Studio, Android Studio, Gemini API, Gemini Enterprise, Gemini 앱에서 즉시 제공
: 3.6 Flash는 Google Antigravity에서도 제공되며, 3.5 Flash-Lite는 Google 검색에 순차 적용
: Gemini 3.5 Pro는 현재 파트너 테스트 중이며 준비가 완료되는 대로 광범위하게 출시할 예정
: 차세대 Gemini 4를 위한 구글의 역대 최대 규모 사전학습도 이미 시작
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber
Google
Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber
We’re introducing new Gemini models, including Gemini 3.6 Flash, 3.5 Flash-Lite and 3.5 Flash Cyber.
❤6👍1
[삼성 이영진] 글로벌 AI/SW 뉴스 🤖 (26/7/22)
■ 구글, Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber 공개
■ 오픈AI, 보안 테스트 중 AI 모델이 샌드박스를 우회해 허깅 페이스 환경에서 자동화된 공객을 수행했다고 공개
■ 오픈AI, Nubank의 창업자 겸 CEO 데이비드 벨리즈와 BNY Mellon CEO 로빈 빈스를 사외이사로 선임. IPO 준비의 일환으로 해석
■ 오픈AI, 중소기업 대상 챗GPT 서비스 출시. 챗GPT Work와 최신 GPT-5.6 모델 포함
■ 샘 올트먼, 미국 정부 관계자들에게 차세대 프런티어 모델 개발 현황과 향후 출시 계획 직접 브리핑 예정
■ 앤스로픽, 상반기 로비 지출액 350만 달러 이상으로 ’25년 연간 310만 달러 상회.
■ 스페이스X, MS 365용 Grok for Outlook 출시. 유료 구독자 대상으로 롤아웃
■ 메타, Threads에 부모 감독 기능 추가. 청소년의 사용시간 확인, 일일 이용 제한, 취침 모드 및 개인정보 설정 관리 기능 제공
■ 문샷 AI, 현재 315억 달러 규모 펀딩 라운드 마무리 이후 최대 500억 달러 밸류로 프리 IPO 라운드 추진 보도
■ 베센트 재무장관, 트럼프 행정부가 오픈소스 AI는 지지하지만, IP 침해 시 제제 가능성 시사
■ 미-중, 9월 AI 관련 정부 간 회담 개최를 추진. 군사 활용, 핵심 인프라 대상 사이버 공격, 노동시장 영향 등 첨단 프런티어 AI 모델의 위험성과 규제 방안을 논의할 예정
■ 코어위브, AI 네이티브 클라우드 구축을 지속하고 있으며, AI 클라우드 매출이 성장할 수록 감가상각비 부담 완화 전망
■ 데이터브릭스, AI 모델 호스팅 수요가 가용 컴퓨팅 캐파를 넘어서면서 여러 지역에서 GPU가 부족한 상황이라는 CEO 코멘트
■ 마이크로소프트-미스트랄 AI, 전략적 파트너십 확대. 유럽 AI 인프라 확대를 위해 수십억 달러 규모 계약 체결
■ 팔로알토 네트웍스, Embrace 인수를 통해 실사용자 모니터링(RUM) 역량 확보
■ 인텔-포티넷, 차세대 SP6 보안 프로세서 개발을 위한 파트너십 확대 발표
감사합니다.
https://t.iss.one/Samsung_Global_AI_SW
■ 구글, Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber 공개
■ 오픈AI, 보안 테스트 중 AI 모델이 샌드박스를 우회해 허깅 페이스 환경에서 자동화된 공객을 수행했다고 공개
■ 오픈AI, Nubank의 창업자 겸 CEO 데이비드 벨리즈와 BNY Mellon CEO 로빈 빈스를 사외이사로 선임. IPO 준비의 일환으로 해석
■ 오픈AI, 중소기업 대상 챗GPT 서비스 출시. 챗GPT Work와 최신 GPT-5.6 모델 포함
■ 샘 올트먼, 미국 정부 관계자들에게 차세대 프런티어 모델 개발 현황과 향후 출시 계획 직접 브리핑 예정
■ 앤스로픽, 상반기 로비 지출액 350만 달러 이상으로 ’25년 연간 310만 달러 상회.
■ 스페이스X, MS 365용 Grok for Outlook 출시. 유료 구독자 대상으로 롤아웃
■ 메타, Threads에 부모 감독 기능 추가. 청소년의 사용시간 확인, 일일 이용 제한, 취침 모드 및 개인정보 설정 관리 기능 제공
■ 문샷 AI, 현재 315억 달러 규모 펀딩 라운드 마무리 이후 최대 500억 달러 밸류로 프리 IPO 라운드 추진 보도
■ 베센트 재무장관, 트럼프 행정부가 오픈소스 AI는 지지하지만, IP 침해 시 제제 가능성 시사
■ 미-중, 9월 AI 관련 정부 간 회담 개최를 추진. 군사 활용, 핵심 인프라 대상 사이버 공격, 노동시장 영향 등 첨단 프런티어 AI 모델의 위험성과 규제 방안을 논의할 예정
■ 코어위브, AI 네이티브 클라우드 구축을 지속하고 있으며, AI 클라우드 매출이 성장할 수록 감가상각비 부담 완화 전망
■ 데이터브릭스, AI 모델 호스팅 수요가 가용 컴퓨팅 캐파를 넘어서면서 여러 지역에서 GPU가 부족한 상황이라는 CEO 코멘트
■ 마이크로소프트-미스트랄 AI, 전략적 파트너십 확대. 유럽 AI 인프라 확대를 위해 수십억 달러 규모 계약 체결
■ 팔로알토 네트웍스, Embrace 인수를 통해 실사용자 모니터링(RUM) 역량 확보
■ 인텔-포티넷, 차세대 SP6 보안 프로세서 개발을 위한 파트너십 확대 발표
감사합니다.
https://t.iss.one/Samsung_Global_AI_SW
Telegram
[삼성 이영진] 글로벌 AI/SW
삼성증권 글로벌 AI/SW 담당 이영진
❤2👍1
메타, 내부 AI 인큐베이터에서 OpenRouter 경쟁 서비스 개발
: 메타의 Applied AI Engineering 조직 산하 AAI Labs가 AI 작업 난이도에 따라 모델을 자동 선택하는 AI 모델 라우터 ‘Switchboard’ 개발 중
: 쉬운 작업은 저비용 소형 모델, 복잡한 작업은 고성능 모델에 할당해 추론 비용 절감을 목표. OpenRouter의 Auto Router와 유사한 방식
: 내부 문서에 따르면 현재는 모든 코딩 요청을 최고 성능 모델이 처리해 “쉬운 작업에도 최고 모델 가격을 지불하고 있다”며, 추론 비용이 AI 에이전트 확산의 가장 큰 제약이라고 평가
: Switchboard는 메타 내부 코딩 에이전트의 추론 비용 절감에 우선 활용한 뒤, 대규모 AI 코딩 에이전트를 운영하는 기업을 대상으로 외부 서비스 출시도 검토
: AAI Labs에서는 소비자 서비스, 개발자 도구, 내부 인프라 등을 포함해 현재 약 200개의 AI 프로젝트가 승인된 상태
: 이 외에도 Apple CarPlay·Android Auto 기반 AI 관광 가이드, 인스타그램 지도 및 Ray-Ban 스마트 안경과 연계 가능한 위치 기반 AI 서비스 등 다양한 신규 프로젝트를 개발 중
: 저커버그 CEO는 AI를 통해 소규모 팀도 빠르게 제품을 개발할 수 있을 것이라며, 향후 최대 50개의 신규 애플리케이션 출시 비전을 제시
https://t.iss.one/Samsung_Global_AI_SW
: 메타의 Applied AI Engineering 조직 산하 AAI Labs가 AI 작업 난이도에 따라 모델을 자동 선택하는 AI 모델 라우터 ‘Switchboard’ 개발 중
: 쉬운 작업은 저비용 소형 모델, 복잡한 작업은 고성능 모델에 할당해 추론 비용 절감을 목표. OpenRouter의 Auto Router와 유사한 방식
: 내부 문서에 따르면 현재는 모든 코딩 요청을 최고 성능 모델이 처리해 “쉬운 작업에도 최고 모델 가격을 지불하고 있다”며, 추론 비용이 AI 에이전트 확산의 가장 큰 제약이라고 평가
: Switchboard는 메타 내부 코딩 에이전트의 추론 비용 절감에 우선 활용한 뒤, 대규모 AI 코딩 에이전트를 운영하는 기업을 대상으로 외부 서비스 출시도 검토
: AAI Labs에서는 소비자 서비스, 개발자 도구, 내부 인프라 등을 포함해 현재 약 200개의 AI 프로젝트가 승인된 상태
: 이 외에도 Apple CarPlay·Android Auto 기반 AI 관광 가이드, 인스타그램 지도 및 Ray-Ban 스마트 안경과 연계 가능한 위치 기반 AI 서비스 등 다양한 신규 프로젝트를 개발 중
: 저커버그 CEO는 AI를 통해 소규모 팀도 빠르게 제품을 개발할 수 있을 것이라며, 향후 최대 50개의 신규 애플리케이션 출시 비전을 제시
https://t.iss.one/Samsung_Global_AI_SW
❤3👍1
[삼성 이영진] 글로벌 AI/SW
구글, Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber 발표 ■ Gemini 3.6 Flash : 코딩, 지식 작업, 멀티모달 성능을 강화한 주력 Flash 모델. 3.5 Flash 대비 출력 토큰 사용량을 17% 줄이고, 더 적은 추론 단계와 도구 호출로 멀티스텝 작업 수행 : 가격은 인풋 $1/5 및 아웃풋 $7.5로 3.5 Flash($1.5 및 $9)보다 인하. 토큰 효율성과 가격을 동시에 개선해 에이전틱…
구글 Gemini 3.6 Flash와 3.5 Flash-Lite 경쟁력 비교
→ 이전 세대 대비 작업 시간 절반 수준 축소 및 토큰 효율 향상에 집중
→ 속도는 최상위권. 컴퓨터 유즈, 차트 해석, 롱컨텍 성능 강조
→ 다만 작업 당 비용 포지셔닝 애매
→ Gemini 3.5 Pro는 대체 언제?
■ 3.6 Flash
: AA Intelligence Index 50점
→ 3.5 Flash와 동일. vs Muse Spark 1.1(51점), GPT-5.6 Luna(51점)
: 평균 작업 시간 1.3분
→ 3.5 Flash 2.7분 대비 50% 이상 단축. 초당 출력 토큰 304개
: 작업 당 비용 $0.5. API 가격 $1.5 및 $7.5
→ 3.5 Flash $0.59, API 가격 $1.5 및 $9.0
→ vs GPT-5.6 Luna($0.21), Muse Spark 1.1($0.26), Grok 4.5($0.31), GLM-5.2($0.47)
■ 3.5 Flash Lite
: AA Intelligence Index 36점
→ 3.1 Flash Lite 25점 대비 11점 상승. DeepSeek V4 Flash(40점)
: 평균 작업 시간 0.6분
→ 3.1 Flash Lite 1분 대비 50% 단축. 초당 출력 토큰 350개
: 작업 당 비용 $0.09. API 가격 $0.3 및 $2.5
→ 3.1 Flash Lite $0.04 대비 상승. API 가격 $0.25 및 $1.5
https://t.iss.one/Samsung_Global_AI_SW
→ 이전 세대 대비 작업 시간 절반 수준 축소 및 토큰 효율 향상에 집중
→ 속도는 최상위권. 컴퓨터 유즈, 차트 해석, 롱컨텍 성능 강조
→ 다만 작업 당 비용 포지셔닝 애매
→ Gemini 3.5 Pro는 대체 언제?
■ 3.6 Flash
: AA Intelligence Index 50점
→ 3.5 Flash와 동일. vs Muse Spark 1.1(51점), GPT-5.6 Luna(51점)
: 평균 작업 시간 1.3분
→ 3.5 Flash 2.7분 대비 50% 이상 단축. 초당 출력 토큰 304개
: 작업 당 비용 $0.5. API 가격 $1.5 및 $7.5
→ 3.5 Flash $0.59, API 가격 $1.5 및 $9.0
→ vs GPT-5.6 Luna($0.21), Muse Spark 1.1($0.26), Grok 4.5($0.31), GLM-5.2($0.47)
■ 3.5 Flash Lite
: AA Intelligence Index 36점
→ 3.1 Flash Lite 25점 대비 11점 상승. DeepSeek V4 Flash(40점)
: 평균 작업 시간 0.6분
→ 3.1 Flash Lite 1분 대비 50% 단축. 초당 출력 토큰 350개
: 작업 당 비용 $0.09. API 가격 $0.3 및 $2.5
→ 3.1 Flash Lite $0.04 대비 상승. API 가격 $0.25 및 $1.5
https://t.iss.one/Samsung_Global_AI_SW
👍2❤1
오픈AI-허깅 페이스, AI 모델 평가 중 발생한 보안 사고 공동 조사 결과 공개
: 허깅 페이스 인프라를 침해한 AI 에이전트 보안 사고가 오픈AI의 내부 사이버 성능 평가 중 발생한 것으로 확인
: GPT-5.6 Sol과 더 강력한 미공개 모델(GPT-6???)이 사이버 안전장치를 완화한 상태에서 ExploitGym 벤치마크를 수행하던 중 사고 발생
: 모델은 오픈AI 연구 환경과 허깅 페이스 운영 인프라의 취약점을 연쇄적으로 악용해운영 데이터베이스에서 평가 정답을 획득
: 오픈AI는 모델이 오직 벤치마크 해결에 집착하며 목표 달성을 위해 극단적인 공격을 수행했다고 설명
: 모델은 패키지 레지스트리 캐시 프록시의 제로데이 취약점을 발견·악용해 인터넷 접근 권한을 확보한 뒤, 권한 상승과 횡적 이동을 거쳐 인터넷 연결 노드에 도달
: 이후 허깅 페이스가 ExploitGym 관련 데이터와 정답을 보유했을 것으로 추론하고, 탈취한 자격 증명과 추가 제로데이 취약점을 조합해 허깅 페이스 서버의 원격 코드 실행(RCE) 경로까지 확보
: 이상 행위는 오픈AI 보안팀이 내부에서 탐지했으며, 허깅 페이스 보안팀도 자체 오픈소스 AI 에이전트를 활용해 공격을 탐지, 차단하고 사고 격리 및 포렌식을 진행. 양사는 현재 공동 조사 중
: 오픈AI는 연구 속도를 일부 희생하더라도 인프라 통제를 강화하고, 발견된 제로데이 취약점을 공급업체에 공개 및 패치를 지원. 허깅 페이스를 Trusted Access 프로그램에 포함해 AI 기반 방어 역량 강화도 지원
: 이번 사고는 실제 서비스에서는 비활성화되지 않는 안전장치를 의도적으로 해제한 내부 평가 환경에서 발생. 오픈AI는 향후 모델 정렬, 평가 환경 보호, 내부 모니터링을 더욱 강화할 계획이라고 발표
: 오픈AI는 이번 사례가 최신 AI 모델이 소스코드 없이도 실제 시스템에서 새로운 공격 경로를 발견하고 장기간의 복합 사이버 공격을 수행할 수 있음을 보여줬다며, 고도화된 AI의 사이버 능력과 함께 방어 기술 및 안전장치도 동일한 속도로 발전해야 한다고 강조
https://openai.com/index/hugging-face-model-evaluation-security-incident/
: 허깅 페이스 인프라를 침해한 AI 에이전트 보안 사고가 오픈AI의 내부 사이버 성능 평가 중 발생한 것으로 확인
: GPT-5.6 Sol과 더 강력한 미공개 모델(GPT-6???)이 사이버 안전장치를 완화한 상태에서 ExploitGym 벤치마크를 수행하던 중 사고 발생
: 모델은 오픈AI 연구 환경과 허깅 페이스 운영 인프라의 취약점을 연쇄적으로 악용해운영 데이터베이스에서 평가 정답을 획득
: 오픈AI는 모델이 오직 벤치마크 해결에 집착하며 목표 달성을 위해 극단적인 공격을 수행했다고 설명
: 모델은 패키지 레지스트리 캐시 프록시의 제로데이 취약점을 발견·악용해 인터넷 접근 권한을 확보한 뒤, 권한 상승과 횡적 이동을 거쳐 인터넷 연결 노드에 도달
: 이후 허깅 페이스가 ExploitGym 관련 데이터와 정답을 보유했을 것으로 추론하고, 탈취한 자격 증명과 추가 제로데이 취약점을 조합해 허깅 페이스 서버의 원격 코드 실행(RCE) 경로까지 확보
: 이상 행위는 오픈AI 보안팀이 내부에서 탐지했으며, 허깅 페이스 보안팀도 자체 오픈소스 AI 에이전트를 활용해 공격을 탐지, 차단하고 사고 격리 및 포렌식을 진행. 양사는 현재 공동 조사 중
: 오픈AI는 연구 속도를 일부 희생하더라도 인프라 통제를 강화하고, 발견된 제로데이 취약점을 공급업체에 공개 및 패치를 지원. 허깅 페이스를 Trusted Access 프로그램에 포함해 AI 기반 방어 역량 강화도 지원
: 이번 사고는 실제 서비스에서는 비활성화되지 않는 안전장치를 의도적으로 해제한 내부 평가 환경에서 발생. 오픈AI는 향후 모델 정렬, 평가 환경 보호, 내부 모니터링을 더욱 강화할 계획이라고 발표
: 오픈AI는 이번 사례가 최신 AI 모델이 소스코드 없이도 실제 시스템에서 새로운 공격 경로를 발견하고 장기간의 복합 사이버 공격을 수행할 수 있음을 보여줬다며, 고도화된 AI의 사이버 능력과 함께 방어 기술 및 안전장치도 동일한 속도로 발전해야 한다고 강조
https://openai.com/index/hugging-face-model-evaluation-security-incident/
OpenAI
OpenAI and Hugging Face partner to address security incident during model evaluation
OpenAI and Hugging Face share early findings from a security incident during AI model evaluation, highlighting advanced cyber capabilities and lessons for defenders.
👍2❤1
샘 올트먼, 미국 정부에 차세대 AI 모델 비공개 브리핑 예정
: 샘 올트먼 CEO는 다음 주 트럼프 행정부 관계자와 미 의회 의원 대상으로 차세대 AI 모델의 성능과 활용, 안전성 등을 비공개 브리핑할 예정
: 브리핑에서는 차세대 모델의 기술 발전과 경제적 영향, 국가안보 및 AI 경쟁력 강화 방안 등이 주요 의제로 논의될 전망
: 이번 일정은 차세대 모델 공개를 앞두고 미국 정부와 정책 공조를 강화하는 차원에서 추진. AI 규제와 안전성 논의에도 영향을 줄 것으로 예상
: 중국의 오픈웨이트 AI 모델 확산과 미국의 AI 전략이 주요 정책 이슈로 떠오른 가운데, 정부의 프런티어 AI 정책 수립에도 참고 자료로 활용될 가능성
: 오픈AI 글로벌 정책총괄 크리스 리헤인은 차세대 모델 제품군이 업무 자동화와 확장성 측면에서 중요한 새로운 기능을 제공할 것이라고 언급
: 미국이 중국과 경쟁하기 위해서는 국가 차원의 통합 AI 전략과 규제 체계를 마련해야 하며, 최근 문샷 AI의 Kimi K3도 이러한 필요성을 보여주는 사례라고 평가
: 미국과 동맹국의 사이버보안 역량 강화를 위해 최첨단 AI 모델을 보안 전문가들이 적시에 활용할 수 있는 절차를 구축하는 것이 중요하다고 강조
: 연방 차원의 AI 규제 기준 마련이 지연될 경우, 매사추세츠주 법안을 시작으로 각 주의 규제를 공통 기준에 맞춰 정렬하는 ‘역연방주의(Reverse Federalism)’ 방식으로 사실상의 전국 표준을 만드는 방안을 추진하겠다고 설명
https://t.iss.one/Samsung_Global_AI_SW
: 샘 올트먼 CEO는 다음 주 트럼프 행정부 관계자와 미 의회 의원 대상으로 차세대 AI 모델의 성능과 활용, 안전성 등을 비공개 브리핑할 예정
: 브리핑에서는 차세대 모델의 기술 발전과 경제적 영향, 국가안보 및 AI 경쟁력 강화 방안 등이 주요 의제로 논의될 전망
: 이번 일정은 차세대 모델 공개를 앞두고 미국 정부와 정책 공조를 강화하는 차원에서 추진. AI 규제와 안전성 논의에도 영향을 줄 것으로 예상
: 중국의 오픈웨이트 AI 모델 확산과 미국의 AI 전략이 주요 정책 이슈로 떠오른 가운데, 정부의 프런티어 AI 정책 수립에도 참고 자료로 활용될 가능성
: 오픈AI 글로벌 정책총괄 크리스 리헤인은 차세대 모델 제품군이 업무 자동화와 확장성 측면에서 중요한 새로운 기능을 제공할 것이라고 언급
: 미국이 중국과 경쟁하기 위해서는 국가 차원의 통합 AI 전략과 규제 체계를 마련해야 하며, 최근 문샷 AI의 Kimi K3도 이러한 필요성을 보여주는 사례라고 평가
: 미국과 동맹국의 사이버보안 역량 강화를 위해 최첨단 AI 모델을 보안 전문가들이 적시에 활용할 수 있는 절차를 구축하는 것이 중요하다고 강조
: 연방 차원의 AI 규제 기준 마련이 지연될 경우, 매사추세츠주 법안을 시작으로 각 주의 규제를 공통 기준에 맞춰 정렬하는 ‘역연방주의(Reverse Federalism)’ 방식으로 사실상의 전국 표준을 만드는 방안을 추진하겠다고 설명
https://t.iss.one/Samsung_Global_AI_SW
❤4👍4
프론티어 AI 기업도 풀악셀 밟아야겠지?
안녕하세요 삼성증권 글로벌 AI/SW 담당 이영진입니다.
오픈AI의 허깅 페이스 보안 사고 업데이트에서 GPT-5.6-Sol보다 강력한 미공개 모델의 존재가 확인되었습니다.
또한 샘 올트먼은 다음 주 미 정부 대상으로 차세대 모델의 성능, 활용, 안정성을 비공개 브리핑할 계획이고,
신규 모델군은 업무 자동화와 확장성 측면에서 새로운 기능을 제공할 것으로 언급되었습니다.
추가로 GPT-6의 높은 성능 관련 X(트위터)발 여러 이야기(난제 해결, 자신의 개발에 적극 참여 등)를 종합해보면
오픈AI의 차세대 모델에 대한 기대감이 스멀스멀 올라오고 있습니다. 8월 출시가 거론되고 있네요
구글의 Gemini 3.6 Flash는 애매한 포지션과 성능을 보였고
Gemini 3.5 Pro는 아직도 나오지 못하며, 기대감을 더 낮춰야할 것 같지만,
차세대 Gemini 4를 위한 구글 역대 최대 규모의 사전학습을 이미 시작했다는 언급이 있었습니다.
추가로 앤스로픽은 이번 주 Opus 5 출시 루머가 있네요
중국이 무섭게 추격하는 상황에서 미국 프론티어 AI 기업의 풀악셀도 계속되고 있습니다.
사실 27일 Kimi K3의 모델 가중치 공개(라이선스 방식 결정)도 모델을 서빙해야하는 하이퍼스케일러 입장에서는 캐파 확장 필요성으로 연결되는 이벤트입니다.
내일 새벽 알파벳이 빅테크 2Q 실적의 포문을 엽니다.
컨센서스(Factset)는 구글 클라우드 매출 222.6억 달러(+63.4%)와 영업이익 69.2억 달러, 분기 CapEx 449.9억 달러를 가리키고 있는데요
시장에 감동을 줄 수 있을까요? 추가 업데이트해 드리겠습니다.
(2026/7/22 공표자료)
안녕하세요 삼성증권 글로벌 AI/SW 담당 이영진입니다.
오픈AI의 허깅 페이스 보안 사고 업데이트에서 GPT-5.6-Sol보다 강력한 미공개 모델의 존재가 확인되었습니다.
또한 샘 올트먼은 다음 주 미 정부 대상으로 차세대 모델의 성능, 활용, 안정성을 비공개 브리핑할 계획이고,
신규 모델군은 업무 자동화와 확장성 측면에서 새로운 기능을 제공할 것으로 언급되었습니다.
추가로 GPT-6의 높은 성능 관련 X(트위터)발 여러 이야기(난제 해결, 자신의 개발에 적극 참여 등)를 종합해보면
오픈AI의 차세대 모델에 대한 기대감이 스멀스멀 올라오고 있습니다. 8월 출시가 거론되고 있네요
구글의 Gemini 3.6 Flash는 애매한 포지션과 성능을 보였고
Gemini 3.5 Pro는 아직도 나오지 못하며, 기대감을 더 낮춰야할 것 같지만,
차세대 Gemini 4를 위한 구글 역대 최대 규모의 사전학습을 이미 시작했다는 언급이 있었습니다.
추가로 앤스로픽은 이번 주 Opus 5 출시 루머가 있네요
중국이 무섭게 추격하는 상황에서 미국 프론티어 AI 기업의 풀악셀도 계속되고 있습니다.
사실 27일 Kimi K3의 모델 가중치 공개(라이선스 방식 결정)도 모델을 서빙해야하는 하이퍼스케일러 입장에서는 캐파 확장 필요성으로 연결되는 이벤트입니다.
내일 새벽 알파벳이 빅테크 2Q 실적의 포문을 엽니다.
컨센서스(Factset)는 구글 클라우드 매출 222.6억 달러(+63.4%)와 영업이익 69.2억 달러, 분기 CapEx 449.9억 달러를 가리키고 있는데요
시장에 감동을 줄 수 있을까요? 추가 업데이트해 드리겠습니다.
(2026/7/22 공표자료)
❤10👍3🔥1🤮1🖕1
미스트랄 AI, 펀딩 라운드별 밸류에이션 및 최근 근황
■ 펀딩 라운드 및 밸류에이션
: 2023년 6월 (Seed)
- 1.05억 유로 조달 / 밸류 2.4억 유로
: 2023년 12월 (Series A)
- 3.85억 유로 조달 / 밸류 20억 유로
- Andreessen Horowitz, BNP Paribas, Salesforce Ventures 등 참여
: 2024년 2월
- 마이크로소프트 전략적 투자(약 1,600만달러), Azure 파트너십 체결
: 2024년 6월 (Series B)
- 6억 유로 조달 / 밸류 58억 유로
: 2025년 9월 (Series C)
- 17억 유로 조달 / 밸류 120억 유로
- ASML이 13억 유로 투자. 약 11% 지분 확보
: 2026년 7월 (논의)
- 수십억 유로(6월 30억 유로 보도) 조달 / 밸류 200억 유로 목표
- 삼성전자, EQT 운용 Scaleup Europe Fund 등 참여 논의 보도
■ 최근 근황
: 올해 초 8.3억 달러 규모 인프라 전용 부채를 조달해 프랑스, 스웨덴 AI 데이터센터 구축 착수
: 마이크로소프트와 수십억 달러 규모 전략적 파트너십 체결. 마이크로소프트가 미스트랄의 유럽 GPU 인프라를 활용하고, Azure 고객에게 미스트랄 모델 제공 예정
: 자체 모델 개발뿐 아니라 GPU 인프라, 데이터센터, 에이전트 플랫폼(Forge), 기업 맞춤형 AI까지 제공하는 유럽형 풀스택 AI 플랫폼 전략으로 사업 영역 확대
: ‘26년 말 ARR 10억 달러 이상 예상
: 30년까지 1GW 규모 AI 컴퓨트 확보를 목표로 유럽 최대 소버린 AI 인프라 구축 추진
https://t.iss.one/Samsung_Global_AI_SW
■ 펀딩 라운드 및 밸류에이션
: 2023년 6월 (Seed)
- 1.05억 유로 조달 / 밸류 2.4억 유로
: 2023년 12월 (Series A)
- 3.85억 유로 조달 / 밸류 20억 유로
- Andreessen Horowitz, BNP Paribas, Salesforce Ventures 등 참여
: 2024년 2월
- 마이크로소프트 전략적 투자(약 1,600만달러), Azure 파트너십 체결
: 2024년 6월 (Series B)
- 6억 유로 조달 / 밸류 58억 유로
: 2025년 9월 (Series C)
- 17억 유로 조달 / 밸류 120억 유로
- ASML이 13억 유로 투자. 약 11% 지분 확보
: 2026년 7월 (논의)
- 수십억 유로(6월 30억 유로 보도) 조달 / 밸류 200억 유로 목표
- 삼성전자, EQT 운용 Scaleup Europe Fund 등 참여 논의 보도
■ 최근 근황
: 올해 초 8.3억 달러 규모 인프라 전용 부채를 조달해 프랑스, 스웨덴 AI 데이터센터 구축 착수
: 마이크로소프트와 수십억 달러 규모 전략적 파트너십 체결. 마이크로소프트가 미스트랄의 유럽 GPU 인프라를 활용하고, Azure 고객에게 미스트랄 모델 제공 예정
: 자체 모델 개발뿐 아니라 GPU 인프라, 데이터센터, 에이전트 플랫폼(Forge), 기업 맞춤형 AI까지 제공하는 유럽형 풀스택 AI 플랫폼 전략으로 사업 영역 확대
: ‘26년 말 ARR 10억 달러 이상 예상
: 30년까지 1GW 규모 AI 컴퓨트 확보를 목표로 유럽 최대 소버린 AI 인프라 구축 추진
https://t.iss.one/Samsung_Global_AI_SW
❤1👍1
젠슨 황, 중국 오픈모델 관련 인터뷰 주요 발언
https://youtube.com/shorts/3IEITJt4Iho
“중국 모델들은 훌륭하다. 우수한 오픈소스 모델은 활용되어야 하며, 미국 기업들도 중국 AI 모델을 당연히 사용할 수 있어야 한다.”
“오픈AI와 앤스로픽이 오픈모델을 두려워할 이유는 없다. 오픈모델은 AI 사용자를 늘려 시장을 확대하고, 편의성과 성능을 원하는 사용자는 여전히 폐쇄형 서비스를 선택할 것이다.”
“중국이 미국 기업들을 시장에서 몰아낼 가능성은 0%다. 시장은 DeepSeek의 영향도 잘못 이해했고, 이번에는 Kimi의 영향도 다시 잘못 해석하고 있다.”
더 저렴한 오픈모델은 AI를 더 많은 사람과 기업에 보급할 것이며, 결국 GPU와 데이터센터, 컴퓨팅 수요를 더 늘릴 것이다. 무료 AI는 하드웨어와 칩, 데이터센터에 모두 긍정적이다.”
“중국 오픈모델이 백도어라는 것은 오해다. 기업들은 샌드박스 환경에서 모델을 수정하고 안전하게 통제할 수 있으며, 모든 것이 하나의 모델, 하나의 공격 지점, 하나의 실패 지점으로 수렴하는 것이 오히려 더 취약하다.”
“앤스로픽의 Claude Mythos도 누구나 사용할 수 있는 서비스 형태로 제공돼야 한다. 앤스로픽의 발전을 막는 것은 미국의 이익에도 도움이 되지 않는다.”
“AI 경쟁은 결승선이 있는 경주가 아니다. 미국도 오랫동안 존재할 것이고 중국도 오랫동안 존재할 것이다.”
“증류(Distillation)는 AI가 학습하는 자연스러운 과정이다. 개인정보 침해나 계약 위반은 처벌해야 하지만, 문제는 잘못된 행위이지 모델 자체가 아니다.”
https://youtube.com/shorts/3IEITJt4Iho
YouTube
Nvidia's Jensen Huang defends Chinese AI amid Kimi panic
Nvidia CEO Jensen Huang defends Chinese AI companies and open AI mo...
🖕3👍2
AMD-앤스로픽, 수백억 달러 규모 AI 인프라 계약 체결 보도
: 앤스로픽은 ‘27년 상반기부터 AMD의 차세대 AI GPU ‘Instinct MI450’을 최대 2GW 규모로 도입 예정
: 자체 데이터센터 구축과 클라우드, 네오클라우드 임대를 병행해 활용
: AMD는 배치 목표 달성에 따라 앤스로픽에 최대 50억달러를 투자 예정. AMD의 첫 앤스로픽 투자 사례
: 양사는 Claude 모델을 활용해 AMD AI 칩 성능을 개선하는 엔지니어링 협력도 추진
: AMD와 앤스로픽은 MI450이 배치될 데이터센터를 공동으로 선정 중
: AMD가 향후 앤스로픽의 데이터센터 임대 계약에 대한 재무적 지급보증을 제공하는 방안도 협의
: 앤스로픽은 현재 구글 TPU, 아마존 Trainium, 엔비디아 GPU를 함께 사용하고 있으며, 이번 계약으로 AMD가 주요 AI 컴퓨팅 공급업체로 추가
: AMD는 최근 오픈AI, 메타에 이어 앤스로픽까지 대형 고객을 확보하며 AI GPU 시장 입지를 확대. 다만 AMD 칩 생태계 확산을 위해 워런트 등 다양한 고객 인센티브도 제공 중
: 앤스로픽은 급증하는 AI 서비스 수요로 일부 사용량 제한과 서비스 장애를 겪고 있으며, 구글, 아마존, 스페이스X에 이어 AMD까지 대규모 컴퓨팅 파트너를 확보
https://t.iss.one/Samsung_Global_AI_SW
: 앤스로픽은 ‘27년 상반기부터 AMD의 차세대 AI GPU ‘Instinct MI450’을 최대 2GW 규모로 도입 예정
: 자체 데이터센터 구축과 클라우드, 네오클라우드 임대를 병행해 활용
: AMD는 배치 목표 달성에 따라 앤스로픽에 최대 50억달러를 투자 예정. AMD의 첫 앤스로픽 투자 사례
: 양사는 Claude 모델을 활용해 AMD AI 칩 성능을 개선하는 엔지니어링 협력도 추진
: AMD와 앤스로픽은 MI450이 배치될 데이터센터를 공동으로 선정 중
: AMD가 향후 앤스로픽의 데이터센터 임대 계약에 대한 재무적 지급보증을 제공하는 방안도 협의
: 앤스로픽은 현재 구글 TPU, 아마존 Trainium, 엔비디아 GPU를 함께 사용하고 있으며, 이번 계약으로 AMD가 주요 AI 컴퓨팅 공급업체로 추가
: AMD는 최근 오픈AI, 메타에 이어 앤스로픽까지 대형 고객을 확보하며 AI GPU 시장 입지를 확대. 다만 AMD 칩 생태계 확산을 위해 워런트 등 다양한 고객 인센티브도 제공 중
: 앤스로픽은 급증하는 AI 서비스 수요로 일부 사용량 제한과 서비스 장애를 겪고 있으며, 구글, 아마존, 스페이스X에 이어 AMD까지 대규모 컴퓨팅 파트너를 확보
https://t.iss.one/Samsung_Global_AI_SW
❤7👍2