[삼성 이영진] 글로벌 AI/SW 뉴스 🤖 (26/7/28)
■ 오픈AI, 샘 올트먼이 워싱턴에서 행정부, 의회 관계자들에게 차기 AI 모델을 사전 공개하고 사이버보안 및 오픈 웨이트 정책 논의 예정
■ 문샷AI, Kimi K3의 가중치와 기술 보고서 및 지원 구성요소를 오픈소스로 공개
■ 엔비디아, 젠슨 황 CEO가 미 의회를 방문해 미국의 AI 주도권과 오픈소스 모델의 중요성을 논의 예정
■ 엔비디아, 일리야 수츠케버의 SSI에 상당한 규모(50억 달러 거론)로 투자하고 GPU 공급을 통해 SSI의 컴퓨팅을 10배 확대하는 장기 협력 체결
■ 엔비디아 주도로 소프트웨어와 AI 에이전트 보안을 위한 Open Secure AI Alliance 출범
■ 마이크로소프트, 첫 자체 사이버보안 특화 모델 MAI-Cyber-1-Flash 공개
■ 구글-마이크로소프트, AI 기반 보안 연구 확산으로 신규 발견되는 소프트웨어 취약점이 사상 최고 수준에 도달했다고 언급
■ 오픈AI, 아일랜드에 EU 본사를 설립하고 250명을 채용하며 유럽 사업과 규제 대응을 위한 현지 조직 확대
■ 앤스로픽, 코그니전트와 기업 고객의 Claude 도입 확대를 위한 파트너십 강화
감사합니다.
https://t.iss.one/Samsung_Global_AI_SW
■ 오픈AI, 샘 올트먼이 워싱턴에서 행정부, 의회 관계자들에게 차기 AI 모델을 사전 공개하고 사이버보안 및 오픈 웨이트 정책 논의 예정
■ 문샷AI, Kimi K3의 가중치와 기술 보고서 및 지원 구성요소를 오픈소스로 공개
■ 엔비디아, 젠슨 황 CEO가 미 의회를 방문해 미국의 AI 주도권과 오픈소스 모델의 중요성을 논의 예정
■ 엔비디아, 일리야 수츠케버의 SSI에 상당한 규모(50억 달러 거론)로 투자하고 GPU 공급을 통해 SSI의 컴퓨팅을 10배 확대하는 장기 협력 체결
■ 엔비디아 주도로 소프트웨어와 AI 에이전트 보안을 위한 Open Secure AI Alliance 출범
■ 마이크로소프트, 첫 자체 사이버보안 특화 모델 MAI-Cyber-1-Flash 공개
■ 구글-마이크로소프트, AI 기반 보안 연구 확산으로 신규 발견되는 소프트웨어 취약점이 사상 최고 수준에 도달했다고 언급
■ 오픈AI, 아일랜드에 EU 본사를 설립하고 250명을 채용하며 유럽 사업과 규제 대응을 위한 현지 조직 확대
■ 앤스로픽, 코그니전트와 기업 고객의 Claude 도입 확대를 위한 파트너십 강화
감사합니다.
https://t.iss.one/Samsung_Global_AI_SW
Telegram
[삼성 이영진] 글로벌 AI/SW
삼성증권 글로벌 AI/SW 담당 이영진
👍3
[삼성 이영진] 글로벌 AI/SW
일리야 수츠케버가 돌아왔다! 이제 SSI를 확장할 때다. 엔비디아와 장기적인 전략적 파트너십을 체결하게 되었음을 발표합니다. 엔비디아는 SSI에 대규모 투자를 진행하며, 이를 통해 향후 12개월 동안 우리의 컴퓨팅 규모를 10배로 확대할 수 있게 됩니다. 우리의 연구가 이제는 본격적으로 규모를 확대할 가치가 있는 단계에 도달했다고 판단했으며, 이번 파트너십을 통해 이를 실현할 수 있게 되었습니다. → SSI는 제품 없이 밸류 320억 달러 달성.…
엔비디아의 SSI 투자 - 일리야 수츠케버의 연구 방향성은?
안녕하세요 삼성증권 글로벌 AI/SW 담당 이영진입니다.
엔비디아가 일리야 수츠케버가 설립한 Safe Superintelligence(SSI)에 대한 투자와 장기 전략적 파트너십을 체결했습니다.
SSI는 엔비디아 Vera Rubin을 활용해 현재보다 10배 확대한 컴퓨팅 캐파를 확보하고, 연구 스케일업을 본격화할 계획입니다.
또한 SSI의 연구 성과를 활용해 엔비디아의 현재 및 차세대 컴퓨팅 플랫폼을 공동으로 발전시키는 기술 협력도 추진 예정입니다.
투자 규모는 공식적으로 알려지지 않았으나, 50억 달러 수준의 현금 투자로 보도되었습니다.
다만 10배 컴퓨팅은 현재 규모 자체를 알 수 없어 추정해볼 수 없고, 하드웨어 공급 일정 및 세부 디테일이 부재한 상황입니다.
올해 3월 엔비디아가 Thinking Machines Lab 투자에서 27년 초 Vera Rubin 배치를 시작해 1GW를 목표로 하는 것과도 결이 다르네요
SSI는 24년 6월 설립 후 2년 간 모델, 데모, 논문, 매출 모두 없지만, 320억 달러 밸류를 인정받고 있고 70억 달러를 조달한 전설의 포켓몬 같은 기업입니다.
엔비디아는 비공개로 유지되어온 SSI의 연구를 이례적으로 검토한 후 파트너십을 결정했고,
수츠케버는 "규모를 확대할 가치가 있는 연구를 확보했다"고 강조했습니다. 별도 X 포스팅을 통해서도 "이제 SSI를 확장할 때다" 라는 코멘트를 남겼습니다.
SSI는 2년간 더 큰 모델 대신 전혀 다른 연구 방향 추진했습니다.
수츠케버는 지난 11월 팟캐스트에서는 AI는 스케일링 시대에서 연구의 시대로 넘어가고 있다고 언급하기도 했는데요
GPU를 많이 사는 회사보다 신규 알고리즘을 먼저 찾고 새로운 학습 레시피 설계 능력이 중요해진다는 이야기입니다.
과거 인터뷰 등에서 힌트를 얻어보면 인간 수준의 일반화, 적은 데이터로 배우는 능력, 감정 및 가치 함수와 등 뇌의 학습 메커니즘 등 뇌가 작동하는 방식 중 충분히 주목받지 못했던 측면에 초점을 맞추고 있습니다.
이제는 스케일업할 SSI의 연구는 과연 무엇일까요?
추가로 흥미로운 점은 SSI가 구글 투자의 투자를 받았고, 초기 TPU 외부 고객으로 알려진 사실입니다. TPU로는 적절한 스케일업이 불가능했다는 판단일까요?
기대를 모으는 SSI의 연구 결과와 캐파 확장은 추가 업데이트해 드리도록 하겠습니다.
(2026/7/28 공표자료)
안녕하세요 삼성증권 글로벌 AI/SW 담당 이영진입니다.
엔비디아가 일리야 수츠케버가 설립한 Safe Superintelligence(SSI)에 대한 투자와 장기 전략적 파트너십을 체결했습니다.
SSI는 엔비디아 Vera Rubin을 활용해 현재보다 10배 확대한 컴퓨팅 캐파를 확보하고, 연구 스케일업을 본격화할 계획입니다.
또한 SSI의 연구 성과를 활용해 엔비디아의 현재 및 차세대 컴퓨팅 플랫폼을 공동으로 발전시키는 기술 협력도 추진 예정입니다.
투자 규모는 공식적으로 알려지지 않았으나, 50억 달러 수준의 현금 투자로 보도되었습니다.
다만 10배 컴퓨팅은 현재 규모 자체를 알 수 없어 추정해볼 수 없고, 하드웨어 공급 일정 및 세부 디테일이 부재한 상황입니다.
올해 3월 엔비디아가 Thinking Machines Lab 투자에서 27년 초 Vera Rubin 배치를 시작해 1GW를 목표로 하는 것과도 결이 다르네요
SSI는 24년 6월 설립 후 2년 간 모델, 데모, 논문, 매출 모두 없지만, 320억 달러 밸류를 인정받고 있고 70억 달러를 조달한 전설의 포켓몬 같은 기업입니다.
엔비디아는 비공개로 유지되어온 SSI의 연구를 이례적으로 검토한 후 파트너십을 결정했고,
수츠케버는 "규모를 확대할 가치가 있는 연구를 확보했다"고 강조했습니다. 별도 X 포스팅을 통해서도 "이제 SSI를 확장할 때다" 라는 코멘트를 남겼습니다.
SSI는 2년간 더 큰 모델 대신 전혀 다른 연구 방향 추진했습니다.
수츠케버는 지난 11월 팟캐스트에서는 AI는 스케일링 시대에서 연구의 시대로 넘어가고 있다고 언급하기도 했는데요
GPU를 많이 사는 회사보다 신규 알고리즘을 먼저 찾고 새로운 학습 레시피 설계 능력이 중요해진다는 이야기입니다.
과거 인터뷰 등에서 힌트를 얻어보면 인간 수준의 일반화, 적은 데이터로 배우는 능력, 감정 및 가치 함수와 등 뇌의 학습 메커니즘 등 뇌가 작동하는 방식 중 충분히 주목받지 못했던 측면에 초점을 맞추고 있습니다.
이제는 스케일업할 SSI의 연구는 과연 무엇일까요?
추가로 흥미로운 점은 SSI가 구글 투자의 투자를 받았고, 초기 TPU 외부 고객으로 알려진 사실입니다. TPU로는 적절한 스케일업이 불가능했다는 판단일까요?
기대를 모으는 SSI의 연구 결과와 캐파 확장은 추가 업데이트해 드리도록 하겠습니다.
(2026/7/28 공표자료)
👍4❤2
Forwarded from [삼성리서치] 테크는 역시 삼성증권
중국DUV는 정해진 방향성이지만 AI사이클과 구분할 필요가 있다
[삼성증권 반도체, IT/이종욱]
7/27(어제밤) 복수의 언론에서 국가 지원 기업의 immersion DUV 노광장비의 양산 가능성을 언급했습니다. SMIC, CXMT를 상대로 26년 5대, 27년 20대 생산 목표이며 아직은 양산성 검증이 필요한 수준입니다. ASML은 25년 131대의 immersion DUV 제품을 출하했습니다. 이 장비는 주로 7nm, 14nm, 28nm등의 반도체를 생산하는데 사용됩니다.
아주 새로운 이야기는 아닙니다. 25년 화웨이와 연계된 상하이 위량성에서 193nm Immersion DUV 개발중이라는 이야기가 있었고 이번 양산도 위량성 개발팀이 주도한 프로젝트로 보입니다. 다만 중국이 Immersion 플랫폼을 국산화한 첫번째 사례로 성능 차이를 논외로 하고 나면 ASML의 2008년 기술 수준까지 확보했다는 점에서 의미가 있습니다.
중국 반도체 생태계는 장기적으로 한국 반도체 산업에 위협 요인인 것은 사실입니다. 또한 중국 반도체의 자립도가 높아지는 것도 불가피한 방향성입니다. 앞으로 반도체 업황이 좋을때나 안 좋을 때나 중국 반도체는 상시적으로 한국 반도체의 위협이 될 것입니다. ASML 등 글로벌 장비 업체에 부정적 뉴스임은 분명해 보입니다.
그러나 적어도 중국 반도체가 이번 AI 반도체 사이클에 미치는 영향은 제한적입니다. 왜냐하면 이번 사이클의 본질은 미국 하이퍼스케일러들과 엔비디아의 데이터센터 생태계에 있기 때문입니다. AI 반도체와 서버디램은 균질한 커머디티가 아닙니다. 품질과 필드 불량률이 직접적인 TCO 차이로 드러나며 검증에는 많은 시간이 필요합니다. 게다가 중국 반도체는 지정학 리스크로부터 자유로울 수 없습니다. 따라서 중국 AI반도체와 중국 디램이 미국 데이터센터 생태계에 진출하는 상황은 상상하기 힘들고, 중국 반도체의 발전 정도에 따라 구글의 Capex가 변화할 가능성도 당분간은 없어 보입니다.
우리는 중국 DUV가 노광장비 기업을 넘어 미국 반도체 주가 하락으로 이어지는 것이 꼬리가 몸통을 흔드는 전형적인 현상이라고 생각합니다. 이를 통해 현재 반도체의 취약한 주식 센티멘트를 재확인하고 있을 뿐입니다. 중국 변수는 이번 사이클의 peak-out 시점에 대한 것이 아닌 다음 사이클 저점의 깊이에 대한 논쟁이며 현재 약 5배 내외에 거래되는 메모리 3사 P/E 멀티플에 상당히 반영되어 있습니다. 그러나 우리가 지금 필요한 것은 이번 사이클이 peak-out했냐의 증거를 찾는 것이고 AI 데이터센터 투자 지속성 논란에 중국 반도체의 영향은 제한적입니다. 이번 사이클의 본질인 AI 데이터센터 투자의 지속성 논란을 정면돌파하는 이벤트가 나올지가 핵심이며 이것에 주목하고 있습니다.
감사합니다.
(2026/7/28 공표자료)
[삼성증권 반도체, IT/이종욱]
7/27(어제밤) 복수의 언론에서 국가 지원 기업의 immersion DUV 노광장비의 양산 가능성을 언급했습니다. SMIC, CXMT를 상대로 26년 5대, 27년 20대 생산 목표이며 아직은 양산성 검증이 필요한 수준입니다. ASML은 25년 131대의 immersion DUV 제품을 출하했습니다. 이 장비는 주로 7nm, 14nm, 28nm등의 반도체를 생산하는데 사용됩니다.
아주 새로운 이야기는 아닙니다. 25년 화웨이와 연계된 상하이 위량성에서 193nm Immersion DUV 개발중이라는 이야기가 있었고 이번 양산도 위량성 개발팀이 주도한 프로젝트로 보입니다. 다만 중국이 Immersion 플랫폼을 국산화한 첫번째 사례로 성능 차이를 논외로 하고 나면 ASML의 2008년 기술 수준까지 확보했다는 점에서 의미가 있습니다.
중국 반도체 생태계는 장기적으로 한국 반도체 산업에 위협 요인인 것은 사실입니다. 또한 중국 반도체의 자립도가 높아지는 것도 불가피한 방향성입니다. 앞으로 반도체 업황이 좋을때나 안 좋을 때나 중국 반도체는 상시적으로 한국 반도체의 위협이 될 것입니다. ASML 등 글로벌 장비 업체에 부정적 뉴스임은 분명해 보입니다.
그러나 적어도 중국 반도체가 이번 AI 반도체 사이클에 미치는 영향은 제한적입니다. 왜냐하면 이번 사이클의 본질은 미국 하이퍼스케일러들과 엔비디아의 데이터센터 생태계에 있기 때문입니다. AI 반도체와 서버디램은 균질한 커머디티가 아닙니다. 품질과 필드 불량률이 직접적인 TCO 차이로 드러나며 검증에는 많은 시간이 필요합니다. 게다가 중국 반도체는 지정학 리스크로부터 자유로울 수 없습니다. 따라서 중국 AI반도체와 중국 디램이 미국 데이터센터 생태계에 진출하는 상황은 상상하기 힘들고, 중국 반도체의 발전 정도에 따라 구글의 Capex가 변화할 가능성도 당분간은 없어 보입니다.
우리는 중국 DUV가 노광장비 기업을 넘어 미국 반도체 주가 하락으로 이어지는 것이 꼬리가 몸통을 흔드는 전형적인 현상이라고 생각합니다. 이를 통해 현재 반도체의 취약한 주식 센티멘트를 재확인하고 있을 뿐입니다. 중국 변수는 이번 사이클의 peak-out 시점에 대한 것이 아닌 다음 사이클 저점의 깊이에 대한 논쟁이며 현재 약 5배 내외에 거래되는 메모리 3사 P/E 멀티플에 상당히 반영되어 있습니다. 그러나 우리가 지금 필요한 것은 이번 사이클이 peak-out했냐의 증거를 찾는 것이고 AI 데이터센터 투자 지속성 논란에 중국 반도체의 영향은 제한적입니다. 이번 사이클의 본질인 AI 데이터센터 투자의 지속성 논란을 정면돌파하는 이벤트가 나올지가 핵심이며 이것에 주목하고 있습니다.
감사합니다.
(2026/7/28 공표자료)
👍6❤3
[삼성 이영진] 글로벌 AI/SW
오픈AI, 대규모 오류 후 약속의 리셋 Codex와 ChatGPT Work의 모든 사용자에 대해 사용 한도를 초기화했습니다. 어젯밤 오전 2시부터 4시 사이, 거의 전 세계적인 수준의 서비스 장애를 겪었습니다. 현재는 모두 정상적으로 복구되었지만, 이제 다음에 무엇이 올지는 아시죠. 우리는 배우고, 초기화했습니다. 마음껏 사용하세요. https://t.iss.one/Samsung_Global_AI_SW
오픈AI, Codex와 ChatGPT Work 한도 리셋
→ 기분이 좋으면 한도를 리셋해주는 오픈AI. 어디 숨겨둔 캐파가..?
https://t.iss.one/Samsung_Global_AI_SW
오늘은 ChatGPT Work의 빠른 확산과, 이를 위해 쏟아진 모든 놀라운 노력들을 함께 축하하고 있습니다. 그래서 사용 한도를 초기화하고 싶은 기분이 듭니다. Ultra와 /fast를 잘 붙잡고 계세요. 몇 시간 뒤 제가 다시 노트북으로 돌아오면 찾아오겠습니다!
노트북으로 돌아왔습니다. Codex와 ChatGPT Work의 모든 유료 사용자에 대한 사용 한도가 초기화되었습니다. 와아아아아아! 정말 좋은 날이네요!
→ 기분이 좋으면 한도를 리셋해주는 오픈AI. 어디 숨겨둔 캐파가..?
https://t.iss.one/Samsung_Global_AI_SW
😁2❤1
[삼성 이영진] 글로벌 AI/SW
문샷 AI, Kimi K3 웨이트 및 기술 보고서 공개까지 12시간 https://huggingface.co/moonshotai/Kimi-K3
문샷 AI, Kimi K3 가중치 공개와 라이선스 정책
안녕하세요 삼성증권 글로벌 AI/SW 담당 이영진입니다.
문샷 AI가 예고대로 Kimi K3의 가중치(웨이트) 공개 및 기술 보고서를 발표했습니다.
모델 측면에서 추가 내용은 활성 파라미터가 104B라는 점입니다(총 파라미터 2.8T)
SFT 단계부터 양자화를 고려한 학습을 적용했지만, 허깅 페이스에 업로드된 파일 사이즈만 1.56TB입니다.
개인도 모델을 돌릴 수는 있습니다. 집에 RTX 5090 80대가 있거나, H100, 200을 구비해놨다면 말이죠
K3의 설계 철학은 3가지 축의 동시 확장입니다.
- 시퀀스 길이(KDA + Gated MLA)
- 네트워크 깊이(AttnRes)
- 모델 넓이(Stable LatenetMoE)
그리고 사후 학습은 3단계를 거쳤습니다.
SFT(에이전트 데이터 학습)
→ RL(일반 추론, 에이전트 코딩 강화)
→ MOPD(다중 교사 증류 - 여러 전문 모델 능력을 하나로 결합)
추가로 FlashKDA(KDA의 순차 recurrent state 갱신과 GPU 활용률), MoonEP(MoE 분산 학습), AgentENV(에이전트 RL 환경)와 같은 핵심 인프라 요소도 오픈소스로 공개했습니다.
다만 라이선스 정책은 기존 K2.6가 MIT 라이선스에 대규모 상업 서비스의 모델 표시 의무만 추가한 형태였다면, Kimi K3 라이선스가 새롭게 도입되었습니다.
K3 라이선스에는 대형 MaaS 사업자에 대한 상업 계약 의무가 신설되었습니다.
K3를 API, 파인튜닝 서비스처럼 서드파티가 실질적으로 제어하는 형태로 제공하고, 라이선스 사용자와 계열사의 최근 12개월 합산 매출이 2,000만 달러를 초과할 경우 상업적 사용 전에 문샷 AI와 별도 계약을 체결해야합니다.
물론 내부 사용과 문샷 AI의 공식 제품 및 인증 추론 파트너를 통한 활용에는 MaaS 계약 및 모델명 표시 의무가 적용되지 않습니다.
인증 추론 파트너와의 별도 계약이 모델 라이선스 사용 계약을 갈음하는 형태입니다.
Kimk K3의 Day 0 런칭, 추론 호스팅 파트너로는 투게더 AI, 디지털오션, 네비우스, 파이어웍스 AI, Baseten가 포함되었습니다.
라이선스 정책 변화는 수익화 필요성을 의미합니다. 다만 모델 침투 측면과 일정 부분 균형을 맞춘 모양입니다.
최근 미국 AI 산업 내 오픈 웨이트 모델 관련 공동 서명이 진행되며 일종의 편 가르기가 진행되고 있습니다
오픈 모델 성장은 AI 인프라에게는 좋습니다. 진영 구축에 엔비디아가 앞장서는 이유기도 하지요
미국 AI 모델 기업 중 공동 서명에 앤스로픽만 참여하지 않았습니다. 아모데이가 별도 의견을 내놓았지만 시선이 곱지는 않네요
이제 확인할 것은 K3의 점유율 추이와 오픈 웨이트 관련 각국 정부의 정책입니다.
(2026/7/28 공표자료)
안녕하세요 삼성증권 글로벌 AI/SW 담당 이영진입니다.
문샷 AI가 예고대로 Kimi K3의 가중치(웨이트) 공개 및 기술 보고서를 발표했습니다.
모델 측면에서 추가 내용은 활성 파라미터가 104B라는 점입니다(총 파라미터 2.8T)
SFT 단계부터 양자화를 고려한 학습을 적용했지만, 허깅 페이스에 업로드된 파일 사이즈만 1.56TB입니다.
개인도 모델을 돌릴 수는 있습니다. 집에 RTX 5090 80대가 있거나, H100, 200을 구비해놨다면 말이죠
K3의 설계 철학은 3가지 축의 동시 확장입니다.
- 시퀀스 길이(KDA + Gated MLA)
- 네트워크 깊이(AttnRes)
- 모델 넓이(Stable LatenetMoE)
그리고 사후 학습은 3단계를 거쳤습니다.
SFT(에이전트 데이터 학습)
→ RL(일반 추론, 에이전트 코딩 강화)
→ MOPD(다중 교사 증류 - 여러 전문 모델 능력을 하나로 결합)
추가로 FlashKDA(KDA의 순차 recurrent state 갱신과 GPU 활용률), MoonEP(MoE 분산 학습), AgentENV(에이전트 RL 환경)와 같은 핵심 인프라 요소도 오픈소스로 공개했습니다.
다만 라이선스 정책은 기존 K2.6가 MIT 라이선스에 대규모 상업 서비스의 모델 표시 의무만 추가한 형태였다면, Kimi K3 라이선스가 새롭게 도입되었습니다.
K3 라이선스에는 대형 MaaS 사업자에 대한 상업 계약 의무가 신설되었습니다.
K3를 API, 파인튜닝 서비스처럼 서드파티가 실질적으로 제어하는 형태로 제공하고, 라이선스 사용자와 계열사의 최근 12개월 합산 매출이 2,000만 달러를 초과할 경우 상업적 사용 전에 문샷 AI와 별도 계약을 체결해야합니다.
물론 내부 사용과 문샷 AI의 공식 제품 및 인증 추론 파트너를 통한 활용에는 MaaS 계약 및 모델명 표시 의무가 적용되지 않습니다.
인증 추론 파트너와의 별도 계약이 모델 라이선스 사용 계약을 갈음하는 형태입니다.
Kimk K3의 Day 0 런칭, 추론 호스팅 파트너로는 투게더 AI, 디지털오션, 네비우스, 파이어웍스 AI, Baseten가 포함되었습니다.
라이선스 정책 변화는 수익화 필요성을 의미합니다. 다만 모델 침투 측면과 일정 부분 균형을 맞춘 모양입니다.
최근 미국 AI 산업 내 오픈 웨이트 모델 관련 공동 서명이 진행되며 일종의 편 가르기가 진행되고 있습니다
오픈 모델 성장은 AI 인프라에게는 좋습니다. 진영 구축에 엔비디아가 앞장서는 이유기도 하지요
미국 AI 모델 기업 중 공동 서명에 앤스로픽만 참여하지 않았습니다. 아모데이가 별도 의견을 내놓았지만 시선이 곱지는 않네요
이제 확인할 것은 K3의 점유율 추이와 오픈 웨이트 관련 각국 정부의 정책입니다.
(2026/7/28 공표자료)
❤2👍2
[삼성 이영진] 글로벌 AI/SW
Hut 8, 텍사스 데이터센터 1단계 상업화 발표 : 15년간 98억 달러 규모 계약. 352MW IT 캐파 리스 계약. 모든 리뉴얼 옵션 행사 시 총 계약 규모 최대 251억 달러 : 고객사는 미공개. AI 학습 및 추론 워크로드를 위한 전용 컴퓨트 인프라 구축 예정 : 텍사스 Beacon Point 전체 캠퍼스는 최대 1GW 캐파 확장 가능. 초기 전력 공급은 27년 1분기 예상 : NVIDIA DSX 레퍼런스 아키텍처 기반 AI 팩토리 구축…
엔비디아, Hut 8 텍사스 1GW AI 데이터센터 장기 임차 확인
: Hut 8이 최근 상업화한 텍사스 Beacon Point 1GW AI 데이터센터 캠퍼스의 장기 임차인이 엔비디아라고 보도
: Hut 8은 기존(1차 5월, 2차 7월 상업화 발표)에서 ‘투자등급 고객’이라고만 공개했으며, 엔비디아가 처음으로 확인
: 엔비디아는 352MW IT 용량 2건(총 704MW IT 용량)에 대해 각각 15년 장기 리스 계약을 체결했으며, 이는 1GW 전력 규모 캠퍼스 전체를 상업화한 계약. 기본 계약 가치는 196억 달러.
: 계약에는 15년 연장 옵션이 포함돼 있으며, 옵션까지 행사될 경우 총 계약 기간은 30년, 최대 계약 규모는 약 502억 달러
: Beacon Point 캠퍼스는 엔비디아의 DGX SuperPOD 및 차세대 AI 클러스터 구축을 위해 설계됐으며, 향후 수십만 개 규모의 엔비디아 GPU를 수용할 수 있는 AI 데이터센터로 개발 예정
: 엔비디아는 시설을 직접 사용하는 동시에 코어위브 등 AI 클라우드 사업자에게 재임대하는 모델도 검토 중이라고 보도. GPU뿐 아니라 전력과 데이터센터까지 선점하는 인프라 전략
: Hut 8은 엔비디아의 신용도를 바탕으로 프로젝트 자금 조달을 추진할 수 있게 됐으며, 대규모 AI 데이터센터 개발 역량을 입증
https://t.iss.one/Samsung_Global_AI_SW
: Hut 8이 최근 상업화한 텍사스 Beacon Point 1GW AI 데이터센터 캠퍼스의 장기 임차인이 엔비디아라고 보도
: Hut 8은 기존(1차 5월, 2차 7월 상업화 발표)에서 ‘투자등급 고객’이라고만 공개했으며, 엔비디아가 처음으로 확인
: 엔비디아는 352MW IT 용량 2건(총 704MW IT 용량)에 대해 각각 15년 장기 리스 계약을 체결했으며, 이는 1GW 전력 규모 캠퍼스 전체를 상업화한 계약. 기본 계약 가치는 196억 달러.
: 계약에는 15년 연장 옵션이 포함돼 있으며, 옵션까지 행사될 경우 총 계약 기간은 30년, 최대 계약 규모는 약 502억 달러
: Beacon Point 캠퍼스는 엔비디아의 DGX SuperPOD 및 차세대 AI 클러스터 구축을 위해 설계됐으며, 향후 수십만 개 규모의 엔비디아 GPU를 수용할 수 있는 AI 데이터센터로 개발 예정
: 엔비디아는 시설을 직접 사용하는 동시에 코어위브 등 AI 클라우드 사업자에게 재임대하는 모델도 검토 중이라고 보도. GPU뿐 아니라 전력과 데이터센터까지 선점하는 인프라 전략
: Hut 8은 엔비디아의 신용도를 바탕으로 프로젝트 자금 조달을 추진할 수 있게 됐으며, 대규모 AI 데이터센터 개발 역량을 입증
https://t.iss.one/Samsung_Global_AI_SW
❤2👍2
아마존, AI 전략 전면 개편. 주력 Nova 모델 축소하고 프론티어 AI 개발 집중
: 아마존은 AI 전략을 전면 개편해 Nova Premier, Nova Omni, Nova Reel, Nova Canvas 등 주력 Nova 모델 개발을 단계적으로 축소하고, 엔지니어 인력과 컴퓨팅 자원을 소수의 프론티어 AI 프로젝트에 집중
: 축소 대상 모델들은 내부적으로 KTLO(Keep the Lights On) 상태로 전환돼 기존 고객 지원은 계속하지만 신규 기능 개발과 연구 투자는 사실상 중단
: 확보 자원은 Frontier Model Research(FMR) 조직으로 이동하고 있으며, Covariant 공동창업자인 피터 아브빌(Pieter Abbeel)이 차세대 플래그십 파운데이션 모델 개발 총괄. 내부 목표는 올해 AWS re:Invent에서 공개
: 이번 개편은 최근 AGI 조직 감원과 AGI Lab 폐쇄에 이은 후속 조치로, AI 조직은 AI 칩과 양자컴퓨팅까지 총괄하는 피터 드산티스(Peter DeSantis) 체제로 재편
: 다만 Nova 브랜드를 종료하는 것은 아니며, Nova 2 Sonic, Nova 2 Lite, Nova Forge, Nova Act는 계속 개발되고, FMR의 차세대 모델 역시 Nova 브랜드로 출시될 가능성
: 아마존은 고객이 사용 중인 기존 Nova 모델은 계속 지원하고, 제품군 개편에 맞춰 마이그레이션 경로도 제공할 계획
https://t.iss.one/Samsung_Global_AI_SW
: 아마존은 AI 전략을 전면 개편해 Nova Premier, Nova Omni, Nova Reel, Nova Canvas 등 주력 Nova 모델 개발을 단계적으로 축소하고, 엔지니어 인력과 컴퓨팅 자원을 소수의 프론티어 AI 프로젝트에 집중
: 축소 대상 모델들은 내부적으로 KTLO(Keep the Lights On) 상태로 전환돼 기존 고객 지원은 계속하지만 신규 기능 개발과 연구 투자는 사실상 중단
: 확보 자원은 Frontier Model Research(FMR) 조직으로 이동하고 있으며, Covariant 공동창업자인 피터 아브빌(Pieter Abbeel)이 차세대 플래그십 파운데이션 모델 개발 총괄. 내부 목표는 올해 AWS re:Invent에서 공개
: 이번 개편은 최근 AGI 조직 감원과 AGI Lab 폐쇄에 이은 후속 조치로, AI 조직은 AI 칩과 양자컴퓨팅까지 총괄하는 피터 드산티스(Peter DeSantis) 체제로 재편
: 다만 Nova 브랜드를 종료하는 것은 아니며, Nova 2 Sonic, Nova 2 Lite, Nova Forge, Nova Act는 계속 개발되고, FMR의 차세대 모델 역시 Nova 브랜드로 출시될 가능성
: 아마존은 고객이 사용 중인 기존 Nova 모델은 계속 지원하고, 제품군 개편에 맞춰 마이그레이션 경로도 제공할 계획
https://t.iss.one/Samsung_Global_AI_SW
❤8👍2💩1
메타-블랙록, 텍사스 El Paso 1GW 데이터센터에 140억 달러 공동 투자
: 메타와 블랙록은 현재 건설 중인 텍사스 El Paso 데이터센터 캠퍼스를 공동 개발, 소유하는 합작법인 설립
: 캠퍼스는 1GW의 컴퓨팅 용량을 갖추고 2028년부터 단계적으로 가동할 예정
: 블랙록 운용 펀드가 합작법인 지분 80%, 메타가 20%를 보유. 건물과 전력, 냉각, 네트워크 등 장기 인프라를 포함한 총 개발비 약 140억 달러를 지분율에 따라 부담
: 거래 종결 시 메타는 약 23억 달러 규모의 토지 및 건설 중인 자산을 출자하고, 블랙록은 약 49억 달러를 현금 출자. 메타는 지분율을 80대20으로 맞추기 위해 약 10억 달러를 일회성으로 지급받을 예정
: 블랙록 투자금의 일부는 125억 달러 규모의 차입금(Debt Financing) 으로 조달하며, 블랙록 산하 글로벌 인프라스트럭처 파트너스(GIP) 와 HPS 인베스트먼트 파트너스(HPS) 도 투자 참여
: 메타는 캠퍼스 전체를 임차하는 최초이자 완공 시점의 유일한 입주자가 되며, 건설관리·행정·자산관리도 담당. 임대기간은 최초 4년에 4회의 연장 옵션을 포함해 최대 20년
: 메타는 최초 약 130억 달러(시간에 따라 감소)의 잔존가치보증(RVG) 을 제공하며, 임대기간 첫 16년 내 특정 조건이 충족될 경우 자산의 공정가치가 보증 기준을 밑돌면 그 차액을 부담
https://about.fb.com/news/2026/07/meta-announces-new-venture-with-blackrock-to-develop-data-center-in-el-paso
: 메타와 블랙록은 현재 건설 중인 텍사스 El Paso 데이터센터 캠퍼스를 공동 개발, 소유하는 합작법인 설립
: 캠퍼스는 1GW의 컴퓨팅 용량을 갖추고 2028년부터 단계적으로 가동할 예정
: 블랙록 운용 펀드가 합작법인 지분 80%, 메타가 20%를 보유. 건물과 전력, 냉각, 네트워크 등 장기 인프라를 포함한 총 개발비 약 140억 달러를 지분율에 따라 부담
: 거래 종결 시 메타는 약 23억 달러 규모의 토지 및 건설 중인 자산을 출자하고, 블랙록은 약 49억 달러를 현금 출자. 메타는 지분율을 80대20으로 맞추기 위해 약 10억 달러를 일회성으로 지급받을 예정
: 블랙록 투자금의 일부는 125억 달러 규모의 차입금(Debt Financing) 으로 조달하며, 블랙록 산하 글로벌 인프라스트럭처 파트너스(GIP) 와 HPS 인베스트먼트 파트너스(HPS) 도 투자 참여
: 메타는 캠퍼스 전체를 임차하는 최초이자 완공 시점의 유일한 입주자가 되며, 건설관리·행정·자산관리도 담당. 임대기간은 최초 4년에 4회의 연장 옵션을 포함해 최대 20년
: 메타는 최초 약 130억 달러(시간에 따라 감소)의 잔존가치보증(RVG) 을 제공하며, 임대기간 첫 16년 내 특정 조건이 충족될 경우 자산의 공정가치가 보증 기준을 밑돌면 그 차액을 부담
https://about.fb.com/news/2026/07/meta-announces-new-venture-with-blackrock-to-develop-data-center-in-el-paso
Meta Newsroom
Meta Announces New Strategic Venture With BlackRock to Develop Data Center in El Paso
Meta and BlackRock announce a venture to finance the development and operation of a data center campus in El Paso, Texas.
❤3👍2
코어 사이언티픽-AMD, 최대 2.5GW AI 데이터센터 파트너십 체결
: 코어 사이언티픽과 AMD는 AMD AI 솔루션 구축을 지원하기 위한 전략적 파트너십을 체결했으며, AMD는 최대 2.5GW 규모 AI 데이터센터 캐파 확보
: 초기에는 2027년부터 미국 내 500MW 이상의 AI 인프라를 제공하며, 향후 고객 수요에 따라 최대 2.5GW까지 단계적으로 확대 가능
: 양사는 AI 데이터센터의 물리적 인프라를 공동 설계하고, AMD Instinct GPU, EPYC CPU, ROCm 소프트웨어를 기반으로 AI 컴퓨팅 환경을 구축할 예정
: AMD는 이번 계약을 통해 모델 개발사, 클라우드 사업자, 기업 고객이 AMD AI 인프라를 더 빠르고 대규모로 도입할 수 있도록 생태계를 확대한다는 전략
: 코어 사이언티픽은 고밀도 AI 데이터센터 구축 역량을 바탕으로 AMD의 차세대 AI 제품 로드맵을 지원하고, 양사 협력을 장기적으로 확대할 계획
: 계약의 일환으로 AMD는 일정한 상업적 조건 충족 시 시장 가격 기준으로 코어 사이언티픽 보통주를 매입할 수 있는 신주인수권(Warrant)도 부여받음
https://investors.corescientific.com/news-events/press-releases/detail/139/core-scientific-announces-second-quarter-2026-results
: 코어 사이언티픽과 AMD는 AMD AI 솔루션 구축을 지원하기 위한 전략적 파트너십을 체결했으며, AMD는 최대 2.5GW 규모 AI 데이터센터 캐파 확보
: 초기에는 2027년부터 미국 내 500MW 이상의 AI 인프라를 제공하며, 향후 고객 수요에 따라 최대 2.5GW까지 단계적으로 확대 가능
: 양사는 AI 데이터센터의 물리적 인프라를 공동 설계하고, AMD Instinct GPU, EPYC CPU, ROCm 소프트웨어를 기반으로 AI 컴퓨팅 환경을 구축할 예정
: AMD는 이번 계약을 통해 모델 개발사, 클라우드 사업자, 기업 고객이 AMD AI 인프라를 더 빠르고 대규모로 도입할 수 있도록 생태계를 확대한다는 전략
: 코어 사이언티픽은 고밀도 AI 데이터센터 구축 역량을 바탕으로 AMD의 차세대 AI 제품 로드맵을 지원하고, 양사 협력을 장기적으로 확대할 계획
: 계약의 일환으로 AMD는 일정한 상업적 조건 충족 시 시장 가격 기준으로 코어 사이언티픽 보통주를 매입할 수 있는 신주인수권(Warrant)도 부여받음
https://investors.corescientific.com/news-events/press-releases/detail/139/core-scientific-announces-second-quarter-2026-results
❤2👍1
문샷 AI, Kimi K4 개발을 위해 엔비디아 블랙웰 GPU 추가 확보 추진
: Kimi K3 성공 이후 K3보다 큰 차세대 모델 Kimi K4 개발을 논의 중이며, 이를 위해 엔비디아 블랙웰 GPU 추가 확보 추진
: 관계자들에 따르면 Kimi K3는 블랙웰 포함 NVIDIA GPU에서 학습. 백악관 과학기술정책실(OSTP) 마이클 크라치오스는 태국 데이터센터를 K3의 학습 클러스터로 지목, 일부 학습은 중국 내에서도 진행된 것으로 알려짐
: 다만 중국의 데이터 반출 규제로 인해 대규모 사전학습 데이터를 해외 데이터센터로 이전하기 어려워 중국 내 학습이 병행됐다는 설명
: 알리바바 Qwen3.8-Max 역시 블랙웰 GPU에서 학습된 것으로 알려짐
: 중국 AI 기업들이 추론에서는 국산 AI 칩 도입을 확대하고 있지만, 프런티어급 AI 모델 학습에서는 여전히 NVIDIA GPU에 크게 의존하고 있음을 보여주는 사례
: 문샷은 K3 학습을 위해 최소 두 개 이상의 중국 클라우드 사업자가 보유한 블랙웰 GPU 자원을 조합해 사용했으며, GPU 간 및 데이터센터 간 통신을 최적화해 대규모 분산학습을 수행
: K3 추론은 미국의 수출 규제로 중국 판매가 허용된 H20 GPU를 중심으로 운영. 출시 직후 폭발적인 수요로 GPU 부족이 발생해 48시간 만에 신규 구독을 일시 중단
: 미국 상무부 산업안보국(BIS)은 문샷 등 중국 AI 기업들의 첨단 미국 AI 칩 접근 여부를 공식 조사 중이며, 중국 기업의 해외 데이터센터를 통한 원격 GPU 접근까지 규제를 확대하는 방안도 검토
https://t.iss.one/Samsung_Global_AI_SW
: Kimi K3 성공 이후 K3보다 큰 차세대 모델 Kimi K4 개발을 논의 중이며, 이를 위해 엔비디아 블랙웰 GPU 추가 확보 추진
: 관계자들에 따르면 Kimi K3는 블랙웰 포함 NVIDIA GPU에서 학습. 백악관 과학기술정책실(OSTP) 마이클 크라치오스는 태국 데이터센터를 K3의 학습 클러스터로 지목, 일부 학습은 중국 내에서도 진행된 것으로 알려짐
: 다만 중국의 데이터 반출 규제로 인해 대규모 사전학습 데이터를 해외 데이터센터로 이전하기 어려워 중국 내 학습이 병행됐다는 설명
: 알리바바 Qwen3.8-Max 역시 블랙웰 GPU에서 학습된 것으로 알려짐
: 중국 AI 기업들이 추론에서는 국산 AI 칩 도입을 확대하고 있지만, 프런티어급 AI 모델 학습에서는 여전히 NVIDIA GPU에 크게 의존하고 있음을 보여주는 사례
: 문샷은 K3 학습을 위해 최소 두 개 이상의 중국 클라우드 사업자가 보유한 블랙웰 GPU 자원을 조합해 사용했으며, GPU 간 및 데이터센터 간 통신을 최적화해 대규모 분산학습을 수행
: K3 추론은 미국의 수출 규제로 중국 판매가 허용된 H20 GPU를 중심으로 운영. 출시 직후 폭발적인 수요로 GPU 부족이 발생해 48시간 만에 신규 구독을 일시 중단
: 미국 상무부 산업안보국(BIS)은 문샷 등 중국 AI 기업들의 첨단 미국 AI 칩 접근 여부를 공식 조사 중이며, 중국 기업의 해외 데이터센터를 통한 원격 GPU 접근까지 규제를 확대하는 방안도 검토
https://t.iss.one/Samsung_Global_AI_SW
❤4👍2
[삼성 이영진] 글로벌 AI/SW
일론 머스크, 2주 후 Grok 4.6, 4주 후 Grok 4.7 공개 예고 Grok 4.5와 Opus 5만이 파레토 프론티어(Pareto Frontier)에 올라 있다. 2주 후 Grok 4.6, 4주 후 Grok 4.7을 공개한다. https://t.iss.one/Samsung_Global_AI_SW
일론 머스크, Grok 4.6과 4.7 출시 타임라인 재강조
https://t.iss.one/Samsung_Global_AI_SW
Grok 4.6는 8/7일 전후에 출시될 예정입니다. 이 모델은 1.5T 파라미터 규모이며, SFT와 RL 크게 개선됩니다.
Grok 4.7은 몇 주 뒤 출시될 예정인 2.1T 파라미터 모델입니다. 거의 모든 면에서 4.6보다 뛰어나지만, 서비스 응답 속도는 약간 느려질 것입니다. 다만 토큰 효율성은 더욱 향상될 예정입니다.
https://t.iss.one/Samsung_Global_AI_SW
❤1👍1
프런티어 AI 기업 직원, ‘Pacing the Frontier’ 공동성명 발표
https://www.pacingthefrontier.com
AI는 훨씬 더 나은 미래를 만드는 데 도움이 될 수 있지만, 그런 결과가 보장된 것은 아닙니다.
세계를 선도하는 AI 기업들은 AI 연구 자체를 AI가 자동화하는 단계에 가까워졌다고 보고 있습니다. 이것이 AI 발전 속도를 정확히 얼마나 가속할지는 예측하기 어렵지만, AI 성능 향상이 우리가 그 시스템을 이해하거나 통제할 수 있는 능력을 넘어설 정도로 빠르게 진행될 위험이 실제로 존재합니다.
AI의 잠재력을 제대로 실현하려면 산업계와 정부, 그리고 사회 전반이 새롭게 나타나는 위험에 대응하고, 보안 대책을 마련하며, 감독 체계를 강화할 시간을 확보할 수 있는 선택지가 필요할 수 있습니다.
하지만 각 기업과 각 국가는 치열한 경쟁에 놓여 있기 때문에, 어느 한쪽이 먼저 AI 개발 속도를 늦추는 결정을 내리기는 매우 어렵습니다. 또한 현재 세계에는 최첨단 AI 전체의 발전 속도를 의도적으로 조절할 수 있는 기술적·거버넌스적 수단도 부족한 상황입니다.
최전선 AI 모델의 출시를 모니터링하기 위해 이미 진행 중인 노력에 더해, 우리는 다음을 요청합니다.
미국 정부가 자동화된 AI 개발의 최전선(frontier) 발전 속도를 의도적으로 조절할 수 있도록 필요한 기술적, 거버넌스적 수단을 마련하기 위한 국제적 협력을 지원해 주기를 요청합니다.
https://www.pacingthefrontier.com
Pacingthefrontier
Pacing the Frontier
A statement from over 1000 employees of frontier AI companies
❤2👍2
Forwarded from [삼성 문준호의 반도체를 전하다]
[삼성 문준호의 반.전] SK하이닉스 2Q26 실적 vs 컨센서스
- 매출액 79.3조원
: +257% y-y, +51% q-q
: 컨센서스 83.9조원 하회
- 영업이익 60.5조원
: +557% y-y, +61% q-q
: 컨센서스 64.0조원 하회
: 영업이익률 76.3%
- 지배주주순이익 93.8조원
: +1,241% y-y, +133% q-q
: 컨센서스 56.2조원 상회
: 지배주주순이익률 118.3%
감사합니다.
- 매출액 79.3조원
: +257% y-y, +51% q-q
: 컨센서스 83.9조원 하회
- 영업이익 60.5조원
: +557% y-y, +61% q-q
: 컨센서스 64.0조원 하회
: 영업이익률 76.3%
- 지배주주순이익 93.8조원
: +1,241% y-y, +133% q-q
: 컨센서스 56.2조원 상회
: 지배주주순이익률 118.3%
감사합니다.
😱10😭3❤2
[삼성 이영진] 글로벌 AI/SW 뉴스 🤖 (26/7/29)
■ 프런티어 AI 기업 직원, 정부에 개발 속도를 의도적으로 관리할 수 있는 규제 체계 도입을 촉구하는 공동 성명 발표
■ 젠슨 황, 워싱턴에서 초당파 의원들과 회동 후 오픈 웨이트 AI 모델이 초기 AI 산업 발전에 핵심적 요소라고 강조
■ 오픈AI-앤스로픽, 8/1일 발표 예정인 미국 정부의 프런티어 AI 평가 프레임워크를 앞두고 행정부 대상 공동 로비. 메타와 스페이스XAI 등 경쟁사 프런티어 AI까지 사전 정부 심사 대항 포함 요구. 중국 오픈웨이트 모델의 보안 및 IP 리스크도 제기
■ 오픈AI, 허깅 페이스를 침해한 AI 에이전트가 또 다른 기술기업의 계정 침해 사실이 확인되었다는 보도. 피해 기업은 공개되지 않음
■ 오픈AI, 문맥 이해와 억양, 다국어, 소음 환경의 음성인식 정확도를 높인 ‘GPT-Live-Transcribe’와 ‘GPT-Transcribe’를 API에 추가
■ 일론 머스크, Grok 4.6의 8/7일 출시 예고
■ 스페이스XAI, SuperGrok Heavy 구독자를 대상으로 ‘Grok Build’ 초기 테스트 버전 출시
■ 스페이스XAI, Grok 4.5를 GitHub Copilot에서 제공
■ 커서, 인도 전용 구독 상품 Cursor Start 출시. 가격은 649루피(월 7달러)
■ 아마존, Nova Premier, Omni, Reel, Canvas 등 자체 AI 모델 개발을 단계적으로 축소하고 피터 아브빌이 이끄는 프런티어 모델 연구(FMR)에 자원 집중
■ 아마존, 구글 TPU 소프트웨어 개발을 이끌었던 Robert Hundt를 영입. Training Neuron 소프트웨어 강화 및 CUDA에 대응하는 자체 AI 칩 생태계 구축 속도
■ 메타-블랙록, 총사업비 약 140억 달러 및 1GW 규모의 텍사스 El Paso 데이터센터 공동 개발. 지분은 블랙록 80% 메타 20%, 2028년 가동 목표
■ 메타, AI 생성 콘텐츠 투명성에 관한 EU AI법 행동강령 서명 예정
■ AMD- 코어사이언티픽, 인프라 파트너십과 임대계약을 체결해 미국 컴퓨팅 용량 500MW 이상을 확보하고 최대 2.5GW까지 확장 가능하며 AMD는 코어사이언티픽 주식 워런트를 수령
■ 미국 FCC, 국가 안보를 이유로 중국산 휴머노이드, 사족보행 로봇과 전력 인버터의 신규 수입을 제한하는 규제 발표 예정
감사합니다.
https://t.iss.one/Samsung_Global_AI_SW
■ 프런티어 AI 기업 직원, 정부에 개발 속도를 의도적으로 관리할 수 있는 규제 체계 도입을 촉구하는 공동 성명 발표
■ 젠슨 황, 워싱턴에서 초당파 의원들과 회동 후 오픈 웨이트 AI 모델이 초기 AI 산업 발전에 핵심적 요소라고 강조
■ 오픈AI-앤스로픽, 8/1일 발표 예정인 미국 정부의 프런티어 AI 평가 프레임워크를 앞두고 행정부 대상 공동 로비. 메타와 스페이스XAI 등 경쟁사 프런티어 AI까지 사전 정부 심사 대항 포함 요구. 중국 오픈웨이트 모델의 보안 및 IP 리스크도 제기
■ 오픈AI, 허깅 페이스를 침해한 AI 에이전트가 또 다른 기술기업의 계정 침해 사실이 확인되었다는 보도. 피해 기업은 공개되지 않음
■ 오픈AI, 문맥 이해와 억양, 다국어, 소음 환경의 음성인식 정확도를 높인 ‘GPT-Live-Transcribe’와 ‘GPT-Transcribe’를 API에 추가
■ 일론 머스크, Grok 4.6의 8/7일 출시 예고
■ 스페이스XAI, SuperGrok Heavy 구독자를 대상으로 ‘Grok Build’ 초기 테스트 버전 출시
■ 스페이스XAI, Grok 4.5를 GitHub Copilot에서 제공
■ 커서, 인도 전용 구독 상품 Cursor Start 출시. 가격은 649루피(월 7달러)
■ 아마존, Nova Premier, Omni, Reel, Canvas 등 자체 AI 모델 개발을 단계적으로 축소하고 피터 아브빌이 이끄는 프런티어 모델 연구(FMR)에 자원 집중
■ 아마존, 구글 TPU 소프트웨어 개발을 이끌었던 Robert Hundt를 영입. Training Neuron 소프트웨어 강화 및 CUDA에 대응하는 자체 AI 칩 생태계 구축 속도
■ 메타-블랙록, 총사업비 약 140억 달러 및 1GW 규모의 텍사스 El Paso 데이터센터 공동 개발. 지분은 블랙록 80% 메타 20%, 2028년 가동 목표
■ 메타, AI 생성 콘텐츠 투명성에 관한 EU AI법 행동강령 서명 예정
■ AMD- 코어사이언티픽, 인프라 파트너십과 임대계약을 체결해 미국 컴퓨팅 용량 500MW 이상을 확보하고 최대 2.5GW까지 확장 가능하며 AMD는 코어사이언티픽 주식 워런트를 수령
■ 미국 FCC, 국가 안보를 이유로 중국산 휴머노이드, 사족보행 로봇과 전력 인버터의 신규 수입을 제한하는 규제 발표 예정
감사합니다.
https://t.iss.one/Samsung_Global_AI_SW
Telegram
[삼성 이영진] 글로벌 AI/SW
삼성증권 글로벌 AI/SW 담당 이영진
👍2
마크 저커버그 기고문 <AI의 미래는 모두를 위한 것>
AI의 미래는 모두를 위한 것이어야 합니다
민주주의와 경제의 역사는 권력이 중앙에 집중될수록 인간의 잠재력이 억눌린다는 사실을 보여줍니다.
우리는 역사적으로 매우 놀라운 시대를 살아가는 행운을 누리고 있습니다. 앞으로 몇 년 안에 사람들은 인간의 능력을 뛰어넘는 초지능을 활용해 놀라운 것을 새롭게 창조하고 발견할 수 있게 될 것입니다.
새로운 사업을 시작하고, 자신의 생각을 표현하며, 새로운 개념을 배우고, 삶과 건강, 인간관계, 경력을 더 나은 방향으로 발전시킬 수 있을 것입니다.
우리 시대의 가장 중요한 질문은 초지능이 등장할 것인가가 아닙니다. 누가 초지능을 이용할 수 있게 될 것인가가 핵심입니다. 초지능이 소수 기관에 집중돼 제한적으로 사용될 것인지, 아니면 모든 사람에게 힘을 실어주는 도구가 될 것인지가 중요합니다.
저는 개인의 역량 강화를 번영의 원천으로, 발명을 초지능의 가장 중요한 목적으로, 권력의 균형을 안전의 토대로 삼는 철학을 제안하고자 합니다.
AI를 개발하는 많은 사람이 AI의 미래를 지나치게 비관적으로 이야기한다는 점은 놀랍습니다. AI가 대부분의 일자리를 없애고 인류의 역할마저 크게 축소할 것이라고 믿으면서도, 왜 그런 미래를 서둘러 만들려 하는지 이해하기 어렵습니다.
AI가 너무 위험하기 때문에 안전을 확보하려면 권력을 극단적으로 집중해야 한다는 주장 역시 그 자체로 위험합니다. 절대적인 권력이 충분히 현명하기만 하면 인류를 선의로 보살필 것이라는 기대는 역사적으로 안전하거나 긍정적인 결과를 낳지 못했습니다.
인류는 지금까지 수많은 혁신적인 변화를 경험했습니다. 새로운 기술이 등장할 때마다 많은 사람이 뒤처질 것이라는 우려가 제기됐습니다.
그러나 결과적으로는 더 많은 사람이 더 큰 번영과 더 나은 건강, 더 많은 자유를 누리게 됐습니다. 우리는 AI도 마찬가지일 것이라고 믿습니다. 미래의 풍요를 모두가 함께 누릴 수 있다고 생각합니다.
우리를 지금의 위치까지 이끈 자유, 열린 탐구, 자유로운 기업 활동, 기회의 평등이라는 가치가 긍정적인 AI의 미래를 만드는 데도 중요한 원칙이 될 것이라고 믿습니다.
인류가 가장 큰 발전을 이룬 것은 사람들이 각자의 목표를 추구할 수 있도록 힘을 쥐여줬을 때였습니다. 새로운 아이디어와 중대한 혁신이 언제나 기존의 거대 기관에서만 나온 것은 아닙니다.
인간이 날 수 있다고 믿었던 자전거 가게의 형제들, 제대로 된 교육을 받지 못했지만 전기를 만들어내는 원리를 발견한 제본공 견습생, 개인용 컴퓨터가 모두를 위한 도구가 될 수 있다고 생각했던 차고 속의 젊은이에게서도 위대한 혁신이 탄생했습니다.
앞으로도 마찬가지일 것입니다. 모든 사람이 더 강력한 도구를 사용할 수 있게 되면, 개인이 미래를 만들어갈 수 있는 능력은 줄어드는 것이 아니라 오히려 더 커질 것입니다.
초지능이 인류에 가져올 가장 큰 기여는 자동화가 아니라 발명일 것입니다. 초기 AI는 질문에 답하고 반복적인 업무를 처리하는 수준이었습니다. 그러나 머지않아 AI는 새로운 지식을 발견하는 데 점점 더 큰 역할을 하게 될 것입니다.
가족의 질병을 치료할 신약을 발견하거나, 사업을 개선할 새로운 방법을 찾아내는 데 도움을 줄 수 있습니다. 사람이 하루 동안 물어볼 수 있는 질문의 수에는 한계가 있지만, 초지능이 우리의 목표 달성을 위해 만들어낼 수 있는 가치 있는 발명의 수에는 한계가 없습니다.
지능이 풍부해질수록 가장 중요한 질문은 그것을 어떤 방향으로 활용할 것인가가 될 것입니다.
일부 사람들은 초지능 자체가, 또는 초지능을 통제하는 소수의 전문가가 인류에게 무엇이 가장 좋은지를 결정해야 한다고 주장합니다. 저는 이에 동의하지 않습니다.
민주주의와 시장경제의 역사는 좋은 삶이 무엇인지에 대해 하나의 객관적인 정답이 존재하지 않는다는 사실을 보여줍니다. 따라서 가장 바람직한 방식은 각자가 자신에게 무엇이 중요한지를 스스로 결정하게 하는 것입니다.
이러한 힘을 중앙에 집중시키는 대신, 우리는 모든 사람에게 개인용 초지능을 제공하는 것이 해답이라고 믿습니다. 이는 개인이 자신의 관심사를 더 자유롭게 추구하고, 자신의 잠재력을 최대한 발휘할 수 있는 새로운 시대를 열 수 있습니다.
건강한 사회는 안전을 위해 견제와 균형이 필요하다는 사실을 인정합니다. 소수의 기관만 초지능을 보유하게 된다면, 이들은 필연적으로 경제와 과학, 정치에 막대한 영향력을 행사하게 될 것입니다.
아무리 선한 의도를 갖고 있더라도 이러한 권력 집중은 사람들이 자신의 미래를 스스로 선택할 수 있는 능력을 제한하게 됩니다.
하나의 사고 실험을 해보겠습니다. 단 한 사람만 초지능 변호사를 보유하고 있다고 상상해 보십시오. 그 사람의 주장이 본질적으로 틀렸더라도 법정에서 부당한 우위를 차지하게 될 것입니다. 이는 더 나쁜 사회를 만들 것입니다.
반대로 모든 사람이 초지능 변호사를 이용할 수 있다고 상상해 보십시오. 사법 절차는 지금보다 훨씬 공정하고 효율적으로 운영될 수 있습니다. 사람들에게 힘이 주어지면 이들은 자연스럽게 서로를 견제하고, 더 큰 기관의 권력도 견제하게 됩니다.
대부분의 사회적 문제는 하나의 선의로 가득한 초지능을 만들어 모든 사람의 가치관에 맞추려는 방식으로 해결할 수 없습니다. 인류는 하나의 동일한 문화와 가치관을 공유하는 집단이 아닙니다.
서로 충돌하는 이해관계와 다양한 가치관을 동시에 모두 만족시키는 기술적 해법은 존재하지 않습니다. 하나의 초지능은 결국 어떤 가치를 다른 가치보다 우선해야 합니다. 그 과정에서 모든 사람에게 선한 존재가 되는 것은 불가능합니다.
물론 여러 위험에 대해서는 진지한 대응이 필요합니다. 사이버보안과 같은 대부분의 영역에서는 오픈소스 소프트웨어의 역사가 보여주듯이, 강력한 시스템에 대한 접근을 폭넓게 개방하는 것이 장기적으로 안전과 보안을 강화하는 가장 좋은 방법이 될 수 있습니다.
생물학적 위험과 같은 일부 위험에 대해서는 강력한 모델을 책임감 있게 배포하기 위해 정부와 기관들이 더 긴밀하게 협력하는 것이 필요할 것입니다.
이러한 원칙은 경제와 일자리의 미래에도 적용됩니다. AI를 사람의 일을 대신하는 자동화 도구로 활용하는 것과, 사람들의 능력을 확장하고 새로운 사업을 만들도록 돕는 도구로 활용하는 것 사이에는 균형이 필요합니다.
그 균형이 자동화 쪽으로 지나치게 기울면 일자리와 경제에 부정적인 영향을 미칠 수 있습니다.
그러나 초지능이 널리 보급된다면 미래에는 일자리가 줄어드는 것이 아니라 오히려 더 많아질 것이라고 생각합니다. 막대한 자본을 조달하지 않고도 사업을 시작하기가 훨씬 쉬워질 것입니다.
경제는 지금보다 더 창업과 기업가 정신을 중심으로 움직이게 될 것이며, 대기업보다 소규모 기업에서 일하는 사람의 비중도 커질 것으로 예상합니다.
초지능의 개발은 우리가 살아가는 동안 경험하게 될 가장 중대한 기술적 발전이 될 것입니다. 메타는 개인의 역량 강화, 발명, 권력의 균형이라는 원칙에 따라 초지능을 개발하는 데 전념하고 있습니다.
인류 역사의 흐름은 더 많은 힘을 사람들의 손에 돌려주는 방향으로 이어져 왔습니다. 이러한 가치가 AI의 미래를 이끌어간다면, 우리는 모두를 위한 긍정적인 미래를 만들 수 있을 것이라고 낙관합니다.
https://www.wsj.com/opinion/the-ai-future-is-for-everyone-a0c24e20?mod=opinion_lead_pos5
AI의 미래는 모두를 위한 것이어야 합니다
민주주의와 경제의 역사는 권력이 중앙에 집중될수록 인간의 잠재력이 억눌린다는 사실을 보여줍니다.
우리는 역사적으로 매우 놀라운 시대를 살아가는 행운을 누리고 있습니다. 앞으로 몇 년 안에 사람들은 인간의 능력을 뛰어넘는 초지능을 활용해 놀라운 것을 새롭게 창조하고 발견할 수 있게 될 것입니다.
새로운 사업을 시작하고, 자신의 생각을 표현하며, 새로운 개념을 배우고, 삶과 건강, 인간관계, 경력을 더 나은 방향으로 발전시킬 수 있을 것입니다.
우리 시대의 가장 중요한 질문은 초지능이 등장할 것인가가 아닙니다. 누가 초지능을 이용할 수 있게 될 것인가가 핵심입니다. 초지능이 소수 기관에 집중돼 제한적으로 사용될 것인지, 아니면 모든 사람에게 힘을 실어주는 도구가 될 것인지가 중요합니다.
저는 개인의 역량 강화를 번영의 원천으로, 발명을 초지능의 가장 중요한 목적으로, 권력의 균형을 안전의 토대로 삼는 철학을 제안하고자 합니다.
AI를 개발하는 많은 사람이 AI의 미래를 지나치게 비관적으로 이야기한다는 점은 놀랍습니다. AI가 대부분의 일자리를 없애고 인류의 역할마저 크게 축소할 것이라고 믿으면서도, 왜 그런 미래를 서둘러 만들려 하는지 이해하기 어렵습니다.
AI가 너무 위험하기 때문에 안전을 확보하려면 권력을 극단적으로 집중해야 한다는 주장 역시 그 자체로 위험합니다. 절대적인 권력이 충분히 현명하기만 하면 인류를 선의로 보살필 것이라는 기대는 역사적으로 안전하거나 긍정적인 결과를 낳지 못했습니다.
인류는 지금까지 수많은 혁신적인 변화를 경험했습니다. 새로운 기술이 등장할 때마다 많은 사람이 뒤처질 것이라는 우려가 제기됐습니다.
그러나 결과적으로는 더 많은 사람이 더 큰 번영과 더 나은 건강, 더 많은 자유를 누리게 됐습니다. 우리는 AI도 마찬가지일 것이라고 믿습니다. 미래의 풍요를 모두가 함께 누릴 수 있다고 생각합니다.
우리를 지금의 위치까지 이끈 자유, 열린 탐구, 자유로운 기업 활동, 기회의 평등이라는 가치가 긍정적인 AI의 미래를 만드는 데도 중요한 원칙이 될 것이라고 믿습니다.
인류가 가장 큰 발전을 이룬 것은 사람들이 각자의 목표를 추구할 수 있도록 힘을 쥐여줬을 때였습니다. 새로운 아이디어와 중대한 혁신이 언제나 기존의 거대 기관에서만 나온 것은 아닙니다.
인간이 날 수 있다고 믿었던 자전거 가게의 형제들, 제대로 된 교육을 받지 못했지만 전기를 만들어내는 원리를 발견한 제본공 견습생, 개인용 컴퓨터가 모두를 위한 도구가 될 수 있다고 생각했던 차고 속의 젊은이에게서도 위대한 혁신이 탄생했습니다.
앞으로도 마찬가지일 것입니다. 모든 사람이 더 강력한 도구를 사용할 수 있게 되면, 개인이 미래를 만들어갈 수 있는 능력은 줄어드는 것이 아니라 오히려 더 커질 것입니다.
초지능이 인류에 가져올 가장 큰 기여는 자동화가 아니라 발명일 것입니다. 초기 AI는 질문에 답하고 반복적인 업무를 처리하는 수준이었습니다. 그러나 머지않아 AI는 새로운 지식을 발견하는 데 점점 더 큰 역할을 하게 될 것입니다.
가족의 질병을 치료할 신약을 발견하거나, 사업을 개선할 새로운 방법을 찾아내는 데 도움을 줄 수 있습니다. 사람이 하루 동안 물어볼 수 있는 질문의 수에는 한계가 있지만, 초지능이 우리의 목표 달성을 위해 만들어낼 수 있는 가치 있는 발명의 수에는 한계가 없습니다.
지능이 풍부해질수록 가장 중요한 질문은 그것을 어떤 방향으로 활용할 것인가가 될 것입니다.
일부 사람들은 초지능 자체가, 또는 초지능을 통제하는 소수의 전문가가 인류에게 무엇이 가장 좋은지를 결정해야 한다고 주장합니다. 저는 이에 동의하지 않습니다.
민주주의와 시장경제의 역사는 좋은 삶이 무엇인지에 대해 하나의 객관적인 정답이 존재하지 않는다는 사실을 보여줍니다. 따라서 가장 바람직한 방식은 각자가 자신에게 무엇이 중요한지를 스스로 결정하게 하는 것입니다.
이러한 힘을 중앙에 집중시키는 대신, 우리는 모든 사람에게 개인용 초지능을 제공하는 것이 해답이라고 믿습니다. 이는 개인이 자신의 관심사를 더 자유롭게 추구하고, 자신의 잠재력을 최대한 발휘할 수 있는 새로운 시대를 열 수 있습니다.
건강한 사회는 안전을 위해 견제와 균형이 필요하다는 사실을 인정합니다. 소수의 기관만 초지능을 보유하게 된다면, 이들은 필연적으로 경제와 과학, 정치에 막대한 영향력을 행사하게 될 것입니다.
아무리 선한 의도를 갖고 있더라도 이러한 권력 집중은 사람들이 자신의 미래를 스스로 선택할 수 있는 능력을 제한하게 됩니다.
하나의 사고 실험을 해보겠습니다. 단 한 사람만 초지능 변호사를 보유하고 있다고 상상해 보십시오. 그 사람의 주장이 본질적으로 틀렸더라도 법정에서 부당한 우위를 차지하게 될 것입니다. 이는 더 나쁜 사회를 만들 것입니다.
반대로 모든 사람이 초지능 변호사를 이용할 수 있다고 상상해 보십시오. 사법 절차는 지금보다 훨씬 공정하고 효율적으로 운영될 수 있습니다. 사람들에게 힘이 주어지면 이들은 자연스럽게 서로를 견제하고, 더 큰 기관의 권력도 견제하게 됩니다.
대부분의 사회적 문제는 하나의 선의로 가득한 초지능을 만들어 모든 사람의 가치관에 맞추려는 방식으로 해결할 수 없습니다. 인류는 하나의 동일한 문화와 가치관을 공유하는 집단이 아닙니다.
서로 충돌하는 이해관계와 다양한 가치관을 동시에 모두 만족시키는 기술적 해법은 존재하지 않습니다. 하나의 초지능은 결국 어떤 가치를 다른 가치보다 우선해야 합니다. 그 과정에서 모든 사람에게 선한 존재가 되는 것은 불가능합니다.
물론 여러 위험에 대해서는 진지한 대응이 필요합니다. 사이버보안과 같은 대부분의 영역에서는 오픈소스 소프트웨어의 역사가 보여주듯이, 강력한 시스템에 대한 접근을 폭넓게 개방하는 것이 장기적으로 안전과 보안을 강화하는 가장 좋은 방법이 될 수 있습니다.
생물학적 위험과 같은 일부 위험에 대해서는 강력한 모델을 책임감 있게 배포하기 위해 정부와 기관들이 더 긴밀하게 협력하는 것이 필요할 것입니다.
이러한 원칙은 경제와 일자리의 미래에도 적용됩니다. AI를 사람의 일을 대신하는 자동화 도구로 활용하는 것과, 사람들의 능력을 확장하고 새로운 사업을 만들도록 돕는 도구로 활용하는 것 사이에는 균형이 필요합니다.
그 균형이 자동화 쪽으로 지나치게 기울면 일자리와 경제에 부정적인 영향을 미칠 수 있습니다.
그러나 초지능이 널리 보급된다면 미래에는 일자리가 줄어드는 것이 아니라 오히려 더 많아질 것이라고 생각합니다. 막대한 자본을 조달하지 않고도 사업을 시작하기가 훨씬 쉬워질 것입니다.
경제는 지금보다 더 창업과 기업가 정신을 중심으로 움직이게 될 것이며, 대기업보다 소규모 기업에서 일하는 사람의 비중도 커질 것으로 예상합니다.
초지능의 개발은 우리가 살아가는 동안 경험하게 될 가장 중대한 기술적 발전이 될 것입니다. 메타는 개인의 역량 강화, 발명, 권력의 균형이라는 원칙에 따라 초지능을 개발하는 데 전념하고 있습니다.
인류 역사의 흐름은 더 많은 힘을 사람들의 손에 돌려주는 방향으로 이어져 왔습니다. 이러한 가치가 AI의 미래를 이끌어간다면, 우리는 모두를 위한 긍정적인 미래를 만들 수 있을 것이라고 낙관합니다.
https://www.wsj.com/opinion/the-ai-future-is-for-everyone-a0c24e20?mod=opinion_lead_pos5
The Wall Street Journal
Opinion | The AI Future Is for Everyone
The history of democracy and economics has proved that centralized power stifles human potential.
👍9❤1
문샷 AI의 Kimi K3 학습도 엔비디아 GPU?
안녕하세요 삼성증권 글로벌 AI/SW 담당 이영진입니다.
전일 발표된 문샷 AI의 Kimi K3 기술 보고서에는 학습 토큰, 학습에 활용한 가속기 및 대수에 대한 내용은 부재했습니다.
다만 커널 최적화 사례가 엔비디아 칩에서 측정되었고, 일부 벤치마크는 엔비디아 H20에 맞춰 측정 조건을 다시 설정했다는 설명이 있었는데요
이후 K3가 블랙웰 포함 엔비디아 GPU에서 학습되었고, 태국과 중국 데이터센터가 활용되었다는 보도가 나왔습니다.
학습을 위해 최소 두 개 이상의 중국 클라우드 사업자가 보유한 블랙웰 GPU 자원을 조합했고, GPU 및 데이터센터 간 통신을 최적화 해 대규모 분산 학습을 수행했다는 내용입니다.
또한 K3의 추론은 H20 GPU 중심으로 진행되고 있고, 문샷 AI는 규모를 확대한 K4 모델 학습을 위한 엔비디아 블랙웰 GPU 추가 확보 추진 내용도 있었습니다.
분산 학습을 위한 통신 최적화에 활용된 인프라 요소는 K3 가중치 공개와 동시에 오픈소스로 공개된 MoonEP입니다.
MoonEP는 MoE 모델의 학습과 추론(prefill) 과정에서 여러 AI 칩에 분산된 전문가(Expert) 간 통신과 부하 분산을 최적화해 대규모 분산 처리 효율을 높이는 라이브러리입니다.
해당 리포지토리의 README 상 한 줄에 주목할 필요가 있는데요
MoonEP의 Supported Devices에는 엔비디아 GPU와 Zhenwu PPU(Under Review, Coming Soon)만 명시되어 있습니다.
Zhenwu는 알리바바 T-Head가 개발한 AI 가속기입니다. CUDA 소스 코드 호환성을 통해 기존 AI 워크로드를 쉽게 이식할 수 있도록 설계된 것이 특징입니다.
최신 공개 제품은 Zhenwu M890(144GB HMB 메모리입니다.
따라서 Zhenwu PPU 지원이 아직 정식 제공 상태는 아니지만, 향후 해당 클러스터에서 MoonEP 기반 MoE 학습 또는 추론을 수행할수 있도록 준비하는 작업으로 해석됩니다.
마침 알리바바는 '24년 문샷 AI의 10억 달러 투자 라운드를 주도했고, 8억 달러를 투자해 36% 지분을 보유했었습니다.
이후 라운드를 거치며 지분율은 희석되었겠지만, 대주주 지위를 유지하며, 주요 클라우드 AI 생태계 파트너 역할을 담당하고 있습니다.
결론적으로 Kimi K3의 학습 인프라 보도는 중국 AI 기업도 프런티어 AI 모델 학습에서는 여전히 엔비디아 GPU에 의존하고 있음을 보여주는 사례입니다.
하지만 장기적으로 국산 반도체 전환이라는 방향성은 이어지고 있습니다.
(2026/7/29 공표자료)
안녕하세요 삼성증권 글로벌 AI/SW 담당 이영진입니다.
전일 발표된 문샷 AI의 Kimi K3 기술 보고서에는 학습 토큰, 학습에 활용한 가속기 및 대수에 대한 내용은 부재했습니다.
다만 커널 최적화 사례가 엔비디아 칩에서 측정되었고, 일부 벤치마크는 엔비디아 H20에 맞춰 측정 조건을 다시 설정했다는 설명이 있었는데요
이후 K3가 블랙웰 포함 엔비디아 GPU에서 학습되었고, 태국과 중국 데이터센터가 활용되었다는 보도가 나왔습니다.
학습을 위해 최소 두 개 이상의 중국 클라우드 사업자가 보유한 블랙웰 GPU 자원을 조합했고, GPU 및 데이터센터 간 통신을 최적화 해 대규모 분산 학습을 수행했다는 내용입니다.
또한 K3의 추론은 H20 GPU 중심으로 진행되고 있고, 문샷 AI는 규모를 확대한 K4 모델 학습을 위한 엔비디아 블랙웰 GPU 추가 확보 추진 내용도 있었습니다.
분산 학습을 위한 통신 최적화에 활용된 인프라 요소는 K3 가중치 공개와 동시에 오픈소스로 공개된 MoonEP입니다.
MoonEP는 MoE 모델의 학습과 추론(prefill) 과정에서 여러 AI 칩에 분산된 전문가(Expert) 간 통신과 부하 분산을 최적화해 대규모 분산 처리 효율을 높이는 라이브러리입니다.
해당 리포지토리의 README 상 한 줄에 주목할 필요가 있는데요
MoonEP의 Supported Devices에는 엔비디아 GPU와 Zhenwu PPU(Under Review, Coming Soon)만 명시되어 있습니다.
Zhenwu는 알리바바 T-Head가 개발한 AI 가속기입니다. CUDA 소스 코드 호환성을 통해 기존 AI 워크로드를 쉽게 이식할 수 있도록 설계된 것이 특징입니다.
최신 공개 제품은 Zhenwu M890(144GB HMB 메모리입니다.
따라서 Zhenwu PPU 지원이 아직 정식 제공 상태는 아니지만, 향후 해당 클러스터에서 MoonEP 기반 MoE 학습 또는 추론을 수행할수 있도록 준비하는 작업으로 해석됩니다.
마침 알리바바는 '24년 문샷 AI의 10억 달러 투자 라운드를 주도했고, 8억 달러를 투자해 36% 지분을 보유했었습니다.
이후 라운드를 거치며 지분율은 희석되었겠지만, 대주주 지위를 유지하며, 주요 클라우드 AI 생태계 파트너 역할을 담당하고 있습니다.
결론적으로 Kimi K3의 학습 인프라 보도는 중국 AI 기업도 프런티어 AI 모델 학습에서는 여전히 엔비디아 GPU에 의존하고 있음을 보여주는 사례입니다.
하지만 장기적으로 국산 반도체 전환이라는 방향성은 이어지고 있습니다.
(2026/7/29 공표자료)
❤6👍2
오픈AI의 탈주 AI 에이전트, 허깅 페이스 외 추가 서비스도 악용
: 오픈AI는 조사 결과 탈주 AI 에이전트가 허깅 페이스 침해 외에도 4개의 공개 서비스 및 리소스에 접근했다고 확인. 이들 서비스는 공격 인프라 구축, 데이터 중계, 흔적 은폐 등에 활용
: 하나는 AI 클라우드 플랫폼 Modal에서 고객이 배포한 애플리케이션으로, 인증 없이 공개된 코드 실행 엔드포인트가 악용된 사례
: Modal CTO는 Modal 플랫폼, 계정, 컨테이너 격리 시스템은 침해되지 않았으며, 고객 애플리케이션의 취약한 설정이 문제였다고 설명
: 허깅 페이스 기술 분석에 따르면 에이전트는 프로덕션 Kubernetes Pod에 침투한 뒤 관리자 및 루트 권한을 확보하고, 클러스터 내부 이동과 클라우드 메타데이터 접근, 내부 네트워크 및 소스코드 공급망 탐색을 수행했으며, 내부 네트워크에 181개의 악성 장치를 등록한 것으로 조사
: 다만 일반 고객 모델, 데이터셋, Spaces, 패키지 유출은 확인되지 않았음
: 오픈AI는 에이전트가 공개 웹에 노출된 자격증명과 취약한 공개 엔드포인트를 이용했으며, 허깅 페이스의 ExploitGym 정답을 탈취해 벤치마크를 ‘부정행위’로 통과하려 한 것으로 판단
: 최종 조사 결과 실제 고객 데이터 가운데 접근된 것은 ExploitGym/CyberGym 정답이 저장된 5개 데이터셋과 일부 운영 메타데이터로 한정
: 추가로 악용된 다른 서비스들에서는 허깅 페이스와 같은 수준의 플랫폼 침해는 확인되지 않았다고 설명
https://huggingface.co/blog/agent-intrusion-technical-timeline
: 오픈AI는 조사 결과 탈주 AI 에이전트가 허깅 페이스 침해 외에도 4개의 공개 서비스 및 리소스에 접근했다고 확인. 이들 서비스는 공격 인프라 구축, 데이터 중계, 흔적 은폐 등에 활용
: 하나는 AI 클라우드 플랫폼 Modal에서 고객이 배포한 애플리케이션으로, 인증 없이 공개된 코드 실행 엔드포인트가 악용된 사례
: Modal CTO는 Modal 플랫폼, 계정, 컨테이너 격리 시스템은 침해되지 않았으며, 고객 애플리케이션의 취약한 설정이 문제였다고 설명
: 허깅 페이스 기술 분석에 따르면 에이전트는 프로덕션 Kubernetes Pod에 침투한 뒤 관리자 및 루트 권한을 확보하고, 클러스터 내부 이동과 클라우드 메타데이터 접근, 내부 네트워크 및 소스코드 공급망 탐색을 수행했으며, 내부 네트워크에 181개의 악성 장치를 등록한 것으로 조사
: 다만 일반 고객 모델, 데이터셋, Spaces, 패키지 유출은 확인되지 않았음
: 오픈AI는 에이전트가 공개 웹에 노출된 자격증명과 취약한 공개 엔드포인트를 이용했으며, 허깅 페이스의 ExploitGym 정답을 탈취해 벤치마크를 ‘부정행위’로 통과하려 한 것으로 판단
: 최종 조사 결과 실제 고객 데이터 가운데 접근된 것은 ExploitGym/CyberGym 정답이 저장된 5개 데이터셋과 일부 운영 메타데이터로 한정
: 추가로 악용된 다른 서비스들에서는 허깅 페이스와 같은 수준의 플랫폼 침해는 확인되지 않았다고 설명
https://huggingface.co/blog/agent-intrusion-technical-timeline
👍2❤1
[삼성 이영진] 글로벌 AI/SW
마크 저커버그 기고문 <AI의 미래는 모두를 위한 것> AI의 미래는 모두를 위한 것이어야 합니다 민주주의와 경제의 역사는 권력이 중앙에 집중될수록 인간의 잠재력이 억눌린다는 사실을 보여줍니다. 우리는 역사적으로 매우 놀라운 시대를 살아가는 행운을 누리고 있습니다. 앞으로 몇 년 안에 사람들은 인간의 능력을 뛰어넘는 초지능을 활용해 놀라운 것을 새롭게 창조하고 발견할 수 있게 될 것입니다. 새로운 사업을 시작하고, 자신의 생각을 표현하며, 새로운…
저커버그, 중국 AI 모델 금지 및 오픈 모델 관련 인터뷰 발언
https://t.iss.one/Samsung_Global_AI_SW
“미국에서 최첨단 중국 AI를 금지하는 것은 효과적인 해결책이 아닙니다.”
“중국과의 AI 경쟁에서 이기려면 미국 기업들이 경쟁력을 떨어뜨리는 병목과 장애 요인을 체계적으로 찾아 해결해야 합니다.”
“AI의 미래는 모두를 위한 것이어야 합니다. AI가 소수의 기관에 중앙집중화되는 것이 아니라, 누구나 활용할 수 있는 도구가 되어야 합니다.”
“사용자가 자신의 하드웨어에서 실행하고 원하는 대로 수정할 수 있는 오픈 모델을 지지합니다.”
“동료 검토(peer review)나 사전 심사(vetting)는 신중한 사람들이 적절하게 운영한다면 업계에 긍정적일 수 있습니다.”
“기업들이 서로를 심사하는 구조에서는 항상 규제 포획(regulatory capture)의 문제가 있습니다. 프런티어 AI 연구소들이 정말 오픈소스 모델의 성공을 원할까요? 그 부분에서는 다소 엇갈린 신호들이 있었다고 생각합니다.”
“사이버보안 우려 때문에 가장 강력한 AI를 제한하는 것은 올바른 해법이 아닙니다. 그런 모델들은 기업들이 취약점을 발견하고 패치하는 데도 도움이 될 수 있습니다.”
“최근 대형 AI 모델과 관련된 보안 사고를 보면, 침해를 당한 기업은 폐쇄형 프런티어 모델에 접근할 수 없었습니다. 접근이 제한돼 있었기 때문입니다. 그래서 결국 오픈소스 모델을 활용해 취약점을 수정해야 했습니다.”
https://t.iss.one/Samsung_Global_AI_SW
❤6👍1😁1
[삼성 이영진] 글로벌 AI/SW
Photo
오픈AI, Sol 개선 사항 적용과 한도 리셋
안녕하세요, Sol 사용자 여러분!
ChatGPT Work와 Codex의 모든 사용자에 대해 사용량 한도를 초기화했습니다. 아울러 GPT-5.6 Sol의 사용량 한도에 대한 업데이트도 공유드립니다.
지난 몇 주 동안 많은 분들이 Sol이 예상보다 Codex 사용 한도를 훨씬 빠르게 소진한다는 의견을 주셨습니다.
분명히 말씀드리면, 어떤 구독 플랜에서도 사용량 한도를 줄인 적은 없습니다.
무슨 일이 있었는지 조사한 결과 여러 개선 사항을 적용했으며, 그 결과 일반적인 Sol 사용 시 사용량이 약 18% 더 오래 유지될 것으로 기대합니다. 일부 사용자는 오늘부터 이미 이보다 훨씬 큰 개선 효과를 체감하고 있을 것입니다.
또한 내일부터는 조사 과정에서 일시적으로 중단했던 5시간 사용 한도도 다시 복원합니다.
Sol 사용량 증가 원인
- 더 오래 작업: 이전 모델보다 작업을 더 오래 이어가며 복잡한 문제를 끝까지 해결하려고 함
- 도구 호출 증가: 웹 검색, 코드 실행, 서브에이전트 등 툴 호출을 더 많이 사용
- 병렬 처리 확대: 여러 툴을 동시에 실행하거나 대기 중에도 계속 작업해 토큰 사용량 증가
- 동일 추론 수준에서도 토큰 사용 증가: GPT-5.6 Sol은 GPT-5.5보다 같은 High 추론 설정에서도 더 많은 토큰 소비
- 파워 유저 영향 집중: 일반 사용자는 큰 문제가 없었지만, 복잡한 작업을 많이 하는 사용자는 사용량이 예상보다 훨씬 빠르게 소진
Sol은 Codex의 기능을 크게 발전시킨 모델이지만, 성능 향상과 효율성 향상이 항상 같은 속도로 이루어지는 것은 아닙니다. 또한 일부 문제는 모델이 실제 대규모 환경에서 사용된 뒤에야 드러납니다.
저희는 이런 문제를 더 빨리 인지하고, 더 투명하게 설명했어야 했습니다.
앞으로도 여러분은 프런티어를 계속 넓혀 주시고, 저희는 효율성을 지속적으로 개선하며 그 과정을 계속 공유드리겠습니다.
→ 어제도 리셋했는데?
https://t.iss.one/Samsung_Global_AI_SW
안녕하세요, Sol 사용자 여러분!
ChatGPT Work와 Codex의 모든 사용자에 대해 사용량 한도를 초기화했습니다. 아울러 GPT-5.6 Sol의 사용량 한도에 대한 업데이트도 공유드립니다.
지난 몇 주 동안 많은 분들이 Sol이 예상보다 Codex 사용 한도를 훨씬 빠르게 소진한다는 의견을 주셨습니다.
분명히 말씀드리면, 어떤 구독 플랜에서도 사용량 한도를 줄인 적은 없습니다.
무슨 일이 있었는지 조사한 결과 여러 개선 사항을 적용했으며, 그 결과 일반적인 Sol 사용 시 사용량이 약 18% 더 오래 유지될 것으로 기대합니다. 일부 사용자는 오늘부터 이미 이보다 훨씬 큰 개선 효과를 체감하고 있을 것입니다.
또한 내일부터는 조사 과정에서 일시적으로 중단했던 5시간 사용 한도도 다시 복원합니다.
Sol 사용량 증가 원인
- 더 오래 작업: 이전 모델보다 작업을 더 오래 이어가며 복잡한 문제를 끝까지 해결하려고 함
- 도구 호출 증가: 웹 검색, 코드 실행, 서브에이전트 등 툴 호출을 더 많이 사용
- 병렬 처리 확대: 여러 툴을 동시에 실행하거나 대기 중에도 계속 작업해 토큰 사용량 증가
- 동일 추론 수준에서도 토큰 사용 증가: GPT-5.6 Sol은 GPT-5.5보다 같은 High 추론 설정에서도 더 많은 토큰 소비
- 파워 유저 영향 집중: 일반 사용자는 큰 문제가 없었지만, 복잡한 작업을 많이 하는 사용자는 사용량이 예상보다 훨씬 빠르게 소진
Sol은 Codex의 기능을 크게 발전시킨 모델이지만, 성능 향상과 효율성 향상이 항상 같은 속도로 이루어지는 것은 아닙니다. 또한 일부 문제는 모델이 실제 대규모 환경에서 사용된 뒤에야 드러납니다.
저희는 이런 문제를 더 빨리 인지하고, 더 투명하게 설명했어야 했습니다.
앞으로도 여러분은 프런티어를 계속 넓혀 주시고, 저희는 효율성을 지속적으로 개선하며 그 과정을 계속 공유드리겠습니다.
→ 어제도 리셋했는데?
https://t.iss.one/Samsung_Global_AI_SW
❤2🤣1