[삼성 이영진] 글로벌 AI/SW
데이터브릭스, 1,340억 달러 밸류로 시리즈 L 펀딩 : 40억 달러 이상 신규 펀딩. 밸류 1,340억 달러 : 3Q 기준 매출 런레이트 48억 달러 돌파(+55% YoY) : 데이터 웨어하우징 사업과 AI 제품에서 각각 연 환산 매출 10억 달러 이상 달성 : 최근 12개월 FCF 흑자 유지 : NRR 140% 이상. 연 매출 100만 달러 이상 고객 700개 이상 https://www.databricks.com/company/newsroom/press…
데이터브릭스, 1,880억 달러 밸류로 전략적 투자 유치
: 기존 투자자 Coatue 주도로 기업가치 1,880억 달러 기준의 전략적 투자 유치 계약(term sheet) 체결
: 올 여름 중 거래를 마무리할 예정이며, 신규 및 기존 투자자도 참여
: 확보 자금은 ▲멀티 AI 거버넌스 및 비용 관리 솔루션 Unity AI Gateway ▲기업 데이터를 AI 답변과 업무로 연결하는 AI 협업 도구 Genie ▲AI 에이전트용 서버리스 PostgreSQL 데이터베이스 Lakebase 투자 확대에 활용 예정
: 데이터브릭스는 기업들이 가장 뛰어난 모델 하나를 모든 작업에 사용하는 대신, 업무별로 가장 효율적인 AI를 선택해 ROI를 추구하는 방향으로 전환하고 있다고 설명
: 이에 따라 다양한 AI 모델을 자유롭게 활용할 수 있는 멀티 AI 전략을 강화해 고객 수요에 대응할 계획
→ 25년 12월 시리즈 L 펀딩 밸류 1,340억 달러
→ 스노우플레이크 시가총액 932억 달러
→ 6월 CEO 알리 고드시는 초대형 IPO가 집중되는 시기에 상장을 서두르지 않을 것 입장 피력
https://www.databricks.com/company/newsroom/press-releases/databricks-raising-strategic-round-funding-188-billion-valuation
: 기존 투자자 Coatue 주도로 기업가치 1,880억 달러 기준의 전략적 투자 유치 계약(term sheet) 체결
: 올 여름 중 거래를 마무리할 예정이며, 신규 및 기존 투자자도 참여
: 확보 자금은 ▲멀티 AI 거버넌스 및 비용 관리 솔루션 Unity AI Gateway ▲기업 데이터를 AI 답변과 업무로 연결하는 AI 협업 도구 Genie ▲AI 에이전트용 서버리스 PostgreSQL 데이터베이스 Lakebase 투자 확대에 활용 예정
: 데이터브릭스는 기업들이 가장 뛰어난 모델 하나를 모든 작업에 사용하는 대신, 업무별로 가장 효율적인 AI를 선택해 ROI를 추구하는 방향으로 전환하고 있다고 설명
: 이에 따라 다양한 AI 모델을 자유롭게 활용할 수 있는 멀티 AI 전략을 강화해 고객 수요에 대응할 계획
→ 25년 12월 시리즈 L 펀딩 밸류 1,340억 달러
→ 스노우플레이크 시가총액 932억 달러
→ 6월 CEO 알리 고드시는 초대형 IPO가 집중되는 시기에 상장을 서두르지 않을 것 입장 피력
https://www.databricks.com/company/newsroom/press-releases/databricks-raising-strategic-round-funding-188-billion-valuation
❤3👍2
[삼성 이영진] 글로벌 AI/SW
문샷 AI, Kimi K3 발표 : 2.8T 파라미터 규모의 Kimi K3 발표. 네이티브 비전, 100만 토큰 컨텍스트. 전체 모델 가중치는 7월 27일 공개 예정 : Artificial AnalysisIntelligence Index 57점. Fable 5(60점), GPT-5.6-Sol(59점)에 이어 3위. Opus 4.8(56점) 상회 : 인풋 $3 및 아웃풋 $15. 기존 K2.6보다 평가에서 출력 토큰 21% 적게 사용 : 작업 당 비용은…
문샷 AI, 이르면 6개월 내 홍콩 IPO 추진
: 투자자들에게 이르면 6개월 내 홍콩 상장을 추진할 계획이라고 설명. 홍콩 상장을 위한 주주결의안 배포 시작
: 회사는 홍콩 IPO를 앞두고 약 315억달러 기업가치로 프리IPO 투자 유치를 추진 중.
: Kimi K3 출시 이후 투자자 관심이 확대되며 상장 작업에도 속도가 붙는 모습
■ 중국 AI 기업의 밸류에이션/ARR
문샷 AI → 315억 달러 / 3억 달러 = 105배
딥시크 → 740억 달러 / 4~5억 달러 = 148~185배
Z.AI → 350억 달러 / 10억 달러 = 35배
미니맥스 → 74억 달러 / 3억 달러 = 25배
https://t.iss.one/Samsung_Global_AI_SW
: 투자자들에게 이르면 6개월 내 홍콩 상장을 추진할 계획이라고 설명. 홍콩 상장을 위한 주주결의안 배포 시작
: 회사는 홍콩 IPO를 앞두고 약 315억달러 기업가치로 프리IPO 투자 유치를 추진 중.
: Kimi K3 출시 이후 투자자 관심이 확대되며 상장 작업에도 속도가 붙는 모습
■ 중국 AI 기업의 밸류에이션/ARR
문샷 AI → 315억 달러 / 3억 달러 = 105배
딥시크 → 740억 달러 / 4~5억 달러 = 148~185배
Z.AI → 350억 달러 / 10억 달러 = 35배
미니맥스 → 74억 달러 / 3억 달러 = 25배
https://t.iss.one/Samsung_Global_AI_SW
❤3👍1
알리바바, Qwen 3.8 공개 예고
: 알리바바가 차세대 언어모델 Qwen 3.8의 출시를 예고. 오픈웨이트 형태로 공개할 예정
: Qwen 3.8은 2.4T 파라미터 규모로, 지속적인 성능 개선을 통해 현재 공개된 AI 모델 가운데 Fable 5에 이어 두 번째 수준의 경쟁력을 갖췄다고 설명
: 정식 출시에 앞서 Qwen3.8-Max-Preview를 Alibaba Token Plan, Qoder, QoderWork에서 먼저 체험할 수 있도록 제공
: 개발자들이 새로운 애플리케이션과 서비스를 구축할 수 있도록 조기 접근을 확대하며, 정식 출시를 앞두고 생태계 참여를 유도할 계획
→ 중국의 다음 타자 Qwen 입장
https://t.iss.one/Samsung_Global_AI_SW
: 알리바바가 차세대 언어모델 Qwen 3.8의 출시를 예고. 오픈웨이트 형태로 공개할 예정
: Qwen 3.8은 2.4T 파라미터 규모로, 지속적인 성능 개선을 통해 현재 공개된 AI 모델 가운데 Fable 5에 이어 두 번째 수준의 경쟁력을 갖췄다고 설명
: 정식 출시에 앞서 Qwen3.8-Max-Preview를 Alibaba Token Plan, Qoder, QoderWork에서 먼저 체험할 수 있도록 제공
: 개발자들이 새로운 애플리케이션과 서비스를 구축할 수 있도록 조기 접근을 확대하며, 정식 출시를 앞두고 생태계 참여를 유도할 계획
→ 중국의 다음 타자 Qwen 입장
https://t.iss.one/Samsung_Global_AI_SW
👍4
문샷AI, Kimi K3의 폭발적 수요에 신규 구독 일시 중단
https://t.iss.one/Samsung_Global_AI_SW
Kimi K3가 예상보다 훨씬 큰 관심을 받으면서, 저희 GPU 인프라에도 상당한 부담이 가해지고 있습니다.
지난 48시간 동안 사용량이 현재 서비스 용량의 한계에 근접했습니다. 기존 유료 구독자들의 안정적인 사용 환경을 유지하기 위해 신규 유료 구독 접수를 일시 중단하고, 현재 구독자에게 컴퓨팅 자원을 우선 배정하기로 했습니다. 기존 유료 구독자는 이번 조치의 영향을 받지 않습니다.
현재 가능한 한 빠른 속도로 컴퓨팅 인프라를 확충하고 있으며, 준비가 완료되는 대로 신규 구독을 순차적으로 다시 개방할 예정입니다.
앞으로는 멤버십도 목적에 맞게 두 가지 상품으로 나눌 계획입니다.
- Kimi Membership: Kimi Web, App, Work 이용자를 위한 멤버십
- Kimi Code Membership: 코딩 워크플로우에 특화된 멤버십
이를 통해 컴퓨팅 자원을 보다 효율적으로 배분하고, 안정적인 서비스 품질을 유지할 수 있을 것으로 기대하고 있습니다.
여러분의 기다림과 이해에 진심으로 감사드립니다.
https://t.iss.one/Samsung_Global_AI_SW
👍3❤2
[삼성 이영진] 글로벌 AI/SW 뉴스 🤖 (26/7/20)
■ 메타, 앤스로픽과 AI 컴퓨팅 인프라 공급 계약 논의 보도. 약 100억달러 규모의 계약 가능성. 계약은 2년간 월별 사용료를 지급하는 구조 검토
■ 오라클 뉴멕시코 Project Jupiter, 파이프라인 인허가 두 번째 거절
■ 스페이스X, 미국 국방부에 AI 모델 구동을 위한 데이터센터 캐파 제공 협상. 계약 규모는 수십억 달러 수준
■ 애플, 오픈AI에서 근무하는 애플 출신 직원 40명에게 문서, 이메일, 메신저 대화 등 관련 자료를 보존하라는 내용의 법률 서한 송부. 오픈AI로 이직한 애플 출신 직원은 400여명
■ 알리바바 클라우드, Agent Native Cloud와 AgentTeams와 Agentic Computer 등 기업용 AI 에이전트 도구 공개
■ 알리바바 T-Head, WAIC 2026에서 자체 개발 AI 소프트웨어 스택 T-Head SAIL을 오픈소스로 공개
■ Z AI, GLM-5.2 흥행 기반으로 ARR 10억 달러 돌파 가능성
감사합니다.
https://t.iss.one/Samsung_Global_AI_SW
■ 메타, 앤스로픽과 AI 컴퓨팅 인프라 공급 계약 논의 보도. 약 100억달러 규모의 계약 가능성. 계약은 2년간 월별 사용료를 지급하는 구조 검토
■ 오라클 뉴멕시코 Project Jupiter, 파이프라인 인허가 두 번째 거절
■ 스페이스X, 미국 국방부에 AI 모델 구동을 위한 데이터센터 캐파 제공 협상. 계약 규모는 수십억 달러 수준
■ 애플, 오픈AI에서 근무하는 애플 출신 직원 40명에게 문서, 이메일, 메신저 대화 등 관련 자료를 보존하라는 내용의 법률 서한 송부. 오픈AI로 이직한 애플 출신 직원은 400여명
■ 알리바바 클라우드, Agent Native Cloud와 AgentTeams와 Agentic Computer 등 기업용 AI 에이전트 도구 공개
■ 알리바바 T-Head, WAIC 2026에서 자체 개발 AI 소프트웨어 스택 T-Head SAIL을 오픈소스로 공개
■ Z AI, GLM-5.2 흥행 기반으로 ARR 10억 달러 돌파 가능성
감사합니다.
https://t.iss.one/Samsung_Global_AI_SW
Telegram
[삼성 이영진] 글로벌 AI/SW
삼성증권 글로벌 AI/SW 담당 이영진
👍2❤1
Forwarded from [삼성리서치] 테크는 역시 삼성증권
Kimi Moment: 격화되는 프론티어 레이스
[삼성증권 리서치 김중한/이영진/이종욱]
지난 7/16 중국 AI-lab 문샷의 새로운 AI 모델 Kimi K3가 세상을 놀라게 했습니다.
앤트로픽과 Open AI 성능에 필적하는 벤치마크 성능을 보여 주며 세상을 놀라게 했습니다.
새로운 키미 쇼크는 25년 딥시크 쇼크와 비교되면서 가뜩이나 불안한 센티멘트의 반도체 섹터를 흔들었습니다.
이에 글로벌주식팀과 합동 보고서를 발간했습니다. 그중 반도체 관점에서 요약드립니다.
1. 무엇이 무서운가?
- 딥시크 쇼크가 중국 모델의 가성비 쇼크였다면,
- 키미 쇼크는 중국이 프론티어 레이스의 선두를 점할 수 있다는 새로운 형태의 공포
2. 컴퓨팅 파워 소요량이 큰 고성능 모델이다
- 896개의 전문가 중 16개만 활성화하는 극단적 MoE, KV캐시를 줄이는 선형어텐션을 사용하여 메모리를 덜 쓰는 모델이 나왔다는 오해가 가능하나...
- 그러나 본질은 반대. 디램 사용량이 너무 많아서 아예 쓰지 못했던 고성능 모델을 쓸 수 있는 수준으로 효율화한 것
- HBM 사용량이 크고, 메모리 요구량도 여전히 높은 편. 64개 가속기 연결한 슈퍼노드 필요.
3. AI 모델 개발 가속화가 반도체 수요의 티핑 포인트이다.
- 경쟁력 있는 AI 모델의 등장은 프론티어 랩의 경쟁을 촉발하고, 기술 개선에 아이디어를 제공
- AI의 기술 개선 속도가 빨라지거나 서비스 배포를 촉진시키는 것이 반도체 수요의 가장 큰 원동력
- 중국 주도의 오픈웨이트 모델도 글로벌 클라우드나 엔터프라이즈 수요를 촉진
4. 미국과 중국 AI는 사실 공생의 선순환 중이다.
- Kimi K3는 미국 AI의 개발 가속화 촉발
- 2025년 딥시크가 Reasoning AI 시대의 개화의 촉매 역할
- 2026년 Kimi3가 Long-Horizon Agent 개화의 촉매 역할 전망
5. 기술이 멈추는 것이 위험하다.
- AI의 성능이 크게 발전하는 것은 반도체 수요에 긍정적
- Kimi K3는 여전히 AI 성능 개선에 메모리를 많이 활용
- AI 성능 개선 속도가 둔화될때 반도체 수요에 위기
6. 반도체 주가에 긍정적 뉴스
- K3는 반도체에 긍정적. 공포심으로 인해 악재로 오인한다면 매수의 기회를 제공
- 이미 주가는 단기 저점에 진입. 주식 쏠림도 해소되는 중
- 반등의 트리거가 필요. 짧게는 클라우드 기업의 실적 발표에서, 길게는 Agent AI 성능 개선을 통한 수요의 실체적 변화 기대
중국에서 경쟁력 있는 AI가 등장하면, 경쟁사에겐 위협이고 공급망에는 호재라고 판단합니다.
리포트 링크: https://bit.ly/4w5HdWS
감사합니다.
(2026/7/20 공표자료)
[삼성증권 리서치 김중한/이영진/이종욱]
지난 7/16 중국 AI-lab 문샷의 새로운 AI 모델 Kimi K3가 세상을 놀라게 했습니다.
앤트로픽과 Open AI 성능에 필적하는 벤치마크 성능을 보여 주며 세상을 놀라게 했습니다.
새로운 키미 쇼크는 25년 딥시크 쇼크와 비교되면서 가뜩이나 불안한 센티멘트의 반도체 섹터를 흔들었습니다.
이에 글로벌주식팀과 합동 보고서를 발간했습니다. 그중 반도체 관점에서 요약드립니다.
1. 무엇이 무서운가?
- 딥시크 쇼크가 중국 모델의 가성비 쇼크였다면,
- 키미 쇼크는 중국이 프론티어 레이스의 선두를 점할 수 있다는 새로운 형태의 공포
2. 컴퓨팅 파워 소요량이 큰 고성능 모델이다
- 896개의 전문가 중 16개만 활성화하는 극단적 MoE, KV캐시를 줄이는 선형어텐션을 사용하여 메모리를 덜 쓰는 모델이 나왔다는 오해가 가능하나...
- 그러나 본질은 반대. 디램 사용량이 너무 많아서 아예 쓰지 못했던 고성능 모델을 쓸 수 있는 수준으로 효율화한 것
- HBM 사용량이 크고, 메모리 요구량도 여전히 높은 편. 64개 가속기 연결한 슈퍼노드 필요.
3. AI 모델 개발 가속화가 반도체 수요의 티핑 포인트이다.
- 경쟁력 있는 AI 모델의 등장은 프론티어 랩의 경쟁을 촉발하고, 기술 개선에 아이디어를 제공
- AI의 기술 개선 속도가 빨라지거나 서비스 배포를 촉진시키는 것이 반도체 수요의 가장 큰 원동력
- 중국 주도의 오픈웨이트 모델도 글로벌 클라우드나 엔터프라이즈 수요를 촉진
4. 미국과 중국 AI는 사실 공생의 선순환 중이다.
- Kimi K3는 미국 AI의 개발 가속화 촉발
- 2025년 딥시크가 Reasoning AI 시대의 개화의 촉매 역할
- 2026년 Kimi3가 Long-Horizon Agent 개화의 촉매 역할 전망
5. 기술이 멈추는 것이 위험하다.
- AI의 성능이 크게 발전하는 것은 반도체 수요에 긍정적
- Kimi K3는 여전히 AI 성능 개선에 메모리를 많이 활용
- AI 성능 개선 속도가 둔화될때 반도체 수요에 위기
6. 반도체 주가에 긍정적 뉴스
- K3는 반도체에 긍정적. 공포심으로 인해 악재로 오인한다면 매수의 기회를 제공
- 이미 주가는 단기 저점에 진입. 주식 쏠림도 해소되는 중
- 반등의 트리거가 필요. 짧게는 클라우드 기업의 실적 발표에서, 길게는 Agent AI 성능 개선을 통한 수요의 실체적 변화 기대
중국에서 경쟁력 있는 AI가 등장하면, 경쟁사에겐 위협이고 공급망에는 호재라고 판단합니다.
리포트 링크: https://bit.ly/4w5HdWS
감사합니다.
(2026/7/20 공표자료)
❤8👍4
[삼성리서치] 테크는 역시 삼성증권
Kimi Moment: 격화되는 프론티어 레이스 [삼성증권 리서치 김중한/이영진/이종욱] 지난 7/16 중국 AI-lab 문샷의 새로운 AI 모델 Kimi K3가 세상을 놀라게 했습니다. 앤트로픽과 Open AI 성능에 필적하는 벤치마크 성능을 보여 주며 세상을 놀라게 했습니다. 새로운 키미 쇼크는 25년 딥시크 쇼크와 비교되면서 가뜩이나 불안한 센티멘트의 반도체 섹터를 흔들었습니다. 이에 글로벌주식팀과 합동 보고서를 발간했습니다. 그중 반도체 관점에서…
Kimi Moment: 격화되는 프론티어 레이스 - AI 모델 관점의 시사점
안녕하세요 삼성증권 글로벌 AI/SW 담당 이영진입니다.
문샷 AI의 Kimi K3가 산업 내 파장을 일으키고 있습니다.
관련해 당 사 Tech팀과 합동 보고서를 작성했는데요. 먼저 K3의 주요 특징과 경쟁력을 살펴봐야합니다.
1) 스케일링 법칙의 유효함을 증명한 오픈 웨이트 최대 규모 모델(2.8T)
2) 중국 AI 모델 특유의 가성비 전략보다 프론티어 모델 경쟁에 본격 합류. AA Index 기준 3위
3) API 가격은 높지 않으나, 대규모 토큰 사용에 따라 작업 당 비용의 강점은 희석
4) 과추론, 느린 속도, 벤치마크 대비 부진한 실체감, 유저 경험 측면 격차 등 한계도 존재
과거 딥시크 쇼크와 비교되지만, 딥시크가 중국 모델의 가성비 쇼크였다면
키미 쇼크(쇼크보다는 모멘트지만)는 중국이 프론티어 레이스의 선두를 점할 수 있다는 새로운 형태의 공포입니다.
제본스 역설은 여전히 작동하고 있습니다. 문샷 AI는 폭발적 수요에 따라 신규 구독의 일시 중단을 발표하기도 했으니까요
물론 프론티어 기업의 적정 밸류에 대한 의구심과 중국 발 쇼크의 일상화는 다소 불편한 요인입니다.
하지만 중요한 것은 사용성입니다. 단순 벤치마크 기준의 성능과 효율성과는 다른 포인트입니다.
향후에는 어떤 모델을 사용하는지보다 얼마의 비용에 어떤 서비스를 제공했는지가 직접적 가치로 연결 될 것 입니다.
그리고 프론티어 레이스는 모델과 인프라 경쟁력 두 가지가 모두 갖춰져야 지속 가능합니다.
또한 K3는 경쟁을 촉발하고 기술 개선에 아이디어를 제공할 수 있습니다. 이는 하드웨어/반도체 수요의 원동력이기도합니다.
미국 프론티어 랩들은 여전히 경쟁에서 앞서 있으며, 공을 다시 넘겨 받은 상황입니다.
자세한 내용은 발간된 보고서를 참고해주시기 바랍니다.
보고서 링크: https://bit.ly/4w5HdWS
(2026/7/20 공표자료)
안녕하세요 삼성증권 글로벌 AI/SW 담당 이영진입니다.
문샷 AI의 Kimi K3가 산업 내 파장을 일으키고 있습니다.
관련해 당 사 Tech팀과 합동 보고서를 작성했는데요. 먼저 K3의 주요 특징과 경쟁력을 살펴봐야합니다.
1) 스케일링 법칙의 유효함을 증명한 오픈 웨이트 최대 규모 모델(2.8T)
2) 중국 AI 모델 특유의 가성비 전략보다 프론티어 모델 경쟁에 본격 합류. AA Index 기준 3위
3) API 가격은 높지 않으나, 대규모 토큰 사용에 따라 작업 당 비용의 강점은 희석
4) 과추론, 느린 속도, 벤치마크 대비 부진한 실체감, 유저 경험 측면 격차 등 한계도 존재
과거 딥시크 쇼크와 비교되지만, 딥시크가 중국 모델의 가성비 쇼크였다면
키미 쇼크(쇼크보다는 모멘트지만)는 중국이 프론티어 레이스의 선두를 점할 수 있다는 새로운 형태의 공포입니다.
제본스 역설은 여전히 작동하고 있습니다. 문샷 AI는 폭발적 수요에 따라 신규 구독의 일시 중단을 발표하기도 했으니까요
물론 프론티어 기업의 적정 밸류에 대한 의구심과 중국 발 쇼크의 일상화는 다소 불편한 요인입니다.
하지만 중요한 것은 사용성입니다. 단순 벤치마크 기준의 성능과 효율성과는 다른 포인트입니다.
향후에는 어떤 모델을 사용하는지보다 얼마의 비용에 어떤 서비스를 제공했는지가 직접적 가치로 연결 될 것 입니다.
그리고 프론티어 레이스는 모델과 인프라 경쟁력 두 가지가 모두 갖춰져야 지속 가능합니다.
또한 K3는 경쟁을 촉발하고 기술 개선에 아이디어를 제공할 수 있습니다. 이는 하드웨어/반도체 수요의 원동력이기도합니다.
미국 프론티어 랩들은 여전히 경쟁에서 앞서 있으며, 공을 다시 넘겨 받은 상황입니다.
자세한 내용은 발간된 보고서를 참고해주시기 바랍니다.
보고서 링크: https://bit.ly/4w5HdWS
(2026/7/20 공표자료)
👍7❤5
IREN, 28억달러 규모 AI 클라우드 신규 계약 체결
: 주요 AI 개발사들과 총계약가치 28억달러 규모의 다년 클라우드 서비스 계약 신규 체결
: 신규 계약을 반영해 ‘26년 말 AI 클라우드 ARR 목표를 기존 37억달러에서 40억달러 이상으로 상향
: 상향된 ARR 목표의 약 85%가 이미 계약으로 확보된 상태
: 최근 계약에는 관련 GPU 자본지출의 약 45%에 해당하는 고객 선급금이 포함돼 IREN의 순자금 조달 부담 완화
: 전체 고객 계약의 가중평균 기간은 약 4년으로, 중장기 매출 가시성도 강화
: 고객사는 마이크로소프트, 엔비디아, 퍼플렉시티, 피규어 AI, 투게더 AI, 플루이드스택, 파이어웍스 AI, Fal AI, 흄 AI 등으로 확대
: ‘26년 480MW, ‘27년 1.2GW의 AI 클라우드 캐파 공급을 목표로 증설 중
https://iren.gcs-web.com/static-files/d6b51979-3c78-46fb-8fae-6e6acefce19c
: 주요 AI 개발사들과 총계약가치 28억달러 규모의 다년 클라우드 서비스 계약 신규 체결
: 신규 계약을 반영해 ‘26년 말 AI 클라우드 ARR 목표를 기존 37억달러에서 40억달러 이상으로 상향
: 상향된 ARR 목표의 약 85%가 이미 계약으로 확보된 상태
: 최근 계약에는 관련 GPU 자본지출의 약 45%에 해당하는 고객 선급금이 포함돼 IREN의 순자금 조달 부담 완화
: 전체 고객 계약의 가중평균 기간은 약 4년으로, 중장기 매출 가시성도 강화
: 고객사는 마이크로소프트, 엔비디아, 퍼플렉시티, 피규어 AI, 투게더 AI, 플루이드스택, 파이어웍스 AI, Fal AI, 흄 AI 등으로 확대
: ‘26년 480MW, ‘27년 1.2GW의 AI 클라우드 캐파 공급을 목표로 증설 중
https://iren.gcs-web.com/static-files/d6b51979-3c78-46fb-8fae-6e6acefce19c
👍8❤3
마이크로소프트, AMD Helios 기반 Azure AI 인프라 확대
: 마이크로소프트와 AMD가 장기 전략적 파트너십을 확대하고, AMD Helios 랙스케일 플랫폼을 Azure에 대규모 도입
: Helios는 MI455X GPU, 6세대 EPYC ‘Venice’ CPU, Pensando 네트워킹, ROCm 소프트웨어를 통합한 시스템으로, 프런티어 모델의 대규모 학습과 추론 지원
: Azure는 Helios 기반 ND MI455X v7과 함께, AI 데이터 처리용 HDv2 및 반도체 설계, HPC용 HXv2 가상머신을 출시할 예정
: HDv2는 데이터 준비, 검색, 강화학습, 에이전트 조정에 최적화됐으며, HXv2는 EDA, 과학 시뮬레이션, 엔지니어링 분석을 겨냥
: AMD는 2026년 하반기부터 Helios 출하를 시작하며, 양사는 Pensando DPU와 Azure Boost 통합을 통해 네트워킹 성능과 효율성도 강화
: Azure는 엔비디아, AMD, 자체 실리콘을 병행하는 이기종 AI 인프라 전략을 확대하고, 추론부터 데이터 처리와 반도체 설계까지 고객 선택권을 확장
https://blogs.microsoft.com/blog/2026/07/20/microsoft-expands-azure-ai-and-hpc-infrastructure-with-amd
: 마이크로소프트와 AMD가 장기 전략적 파트너십을 확대하고, AMD Helios 랙스케일 플랫폼을 Azure에 대규모 도입
: Helios는 MI455X GPU, 6세대 EPYC ‘Venice’ CPU, Pensando 네트워킹, ROCm 소프트웨어를 통합한 시스템으로, 프런티어 모델의 대규모 학습과 추론 지원
: Azure는 Helios 기반 ND MI455X v7과 함께, AI 데이터 처리용 HDv2 및 반도체 설계, HPC용 HXv2 가상머신을 출시할 예정
: HDv2는 데이터 준비, 검색, 강화학습, 에이전트 조정에 최적화됐으며, HXv2는 EDA, 과학 시뮬레이션, 엔지니어링 분석을 겨냥
: AMD는 2026년 하반기부터 Helios 출하를 시작하며, 양사는 Pensando DPU와 Azure Boost 통합을 통해 네트워킹 성능과 효율성도 강화
: Azure는 엔비디아, AMD, 자체 실리콘을 병행하는 이기종 AI 인프라 전략을 확대하고, 추론부터 데이터 처리와 반도체 설계까지 고객 선택권을 확장
https://blogs.microsoft.com/blog/2026/07/20/microsoft-expands-azure-ai-and-hpc-infrastructure-with-amd
The Official Microsoft Blog
Microsoft expands Azure AI and HPC infrastructure with AMD
AI workloads are scaling faster than any single infrastructure approach can support — with more models, new agent-driven workloads and surging compute demand driving the need for greater specialization across the stack. To meet this need, Microsoft continues…
❤3👍2
구글, Gemini 전용 AI 추론 칩 'Frozen v2' 개발 추진
: Gemini 모델 아키텍처를 칩에 직접 통합하는 신규 서버용 AI 추론 칩 'Frozen v2'를 개발 중이며, 2028년 배치를 목표로 추진
: Gemini 모델의 일부 연산과 의사결정을 칩 내부에 미리 구현해 데이터 이동과 연산 단계를 줄임으로써, 현재 최신 TPU 대비 전력당 토큰 처리 효율이 6~10배 향상될 것으로 내부 전망
: 범용 AI 칩인 TPU를 대체하는 것이 아니라, Gemini 전용 추론을 위한 새로운 자체 AI 칩 계열로 개발
: AI 컴퓨팅 부족으로 내부 갈등이 발생하고 Google Cloud가 일부 외부 고객 계약을 거절한 가운데, Gemini 추론 효율과 응답 속도를 높여 AI 컴퓨팅 부족을 완화하는 것이 목표
: 향후 Gemini 모델이 현재와 동일한 기본 아키텍처를 유지해야 활용도가 높지만, 모델 가중치는 업데이트할 수 있도록 설계 중
: 기존에는 모델 가중치 자체를 칩에 새겨 넣는 'Frozen' 프로젝트를 검토했으나, 특정 버전의 Gemini에서만 사용할 수 있어 칩 수명이 짧다는 이유로 폐기
: SambaNova, d-Matrix, 오픈AI, 마이크로소프트 등도 추론 전용 AI 칩을 개발 중이며, 구글의 접근 방식은 특정 AI 모델을 칩에 내장하는 캐나다 스타트업 Taalas와 유사
: TPU만큼 대규모 생산할 계획은 없으며, 차세대 특화 AI 칩 개발을 위한 시험 프로젝트 성격도 포함
https://t.iss.one/Samsung_Global_AI_SW
: Gemini 모델 아키텍처를 칩에 직접 통합하는 신규 서버용 AI 추론 칩 'Frozen v2'를 개발 중이며, 2028년 배치를 목표로 추진
: Gemini 모델의 일부 연산과 의사결정을 칩 내부에 미리 구현해 데이터 이동과 연산 단계를 줄임으로써, 현재 최신 TPU 대비 전력당 토큰 처리 효율이 6~10배 향상될 것으로 내부 전망
: 범용 AI 칩인 TPU를 대체하는 것이 아니라, Gemini 전용 추론을 위한 새로운 자체 AI 칩 계열로 개발
: AI 컴퓨팅 부족으로 내부 갈등이 발생하고 Google Cloud가 일부 외부 고객 계약을 거절한 가운데, Gemini 추론 효율과 응답 속도를 높여 AI 컴퓨팅 부족을 완화하는 것이 목표
: 향후 Gemini 모델이 현재와 동일한 기본 아키텍처를 유지해야 활용도가 높지만, 모델 가중치는 업데이트할 수 있도록 설계 중
: 기존에는 모델 가중치 자체를 칩에 새겨 넣는 'Frozen' 프로젝트를 검토했으나, 특정 버전의 Gemini에서만 사용할 수 있어 칩 수명이 짧다는 이유로 폐기
: SambaNova, d-Matrix, 오픈AI, 마이크로소프트 등도 추론 전용 AI 칩을 개발 중이며, 구글의 접근 방식은 특정 AI 모델을 칩에 내장하는 캐나다 스타트업 Taalas와 유사
: TPU만큼 대규모 생산할 계획은 없으며, 차세대 특화 AI 칩 개발을 위한 시험 프로젝트 성격도 포함
https://t.iss.one/Samsung_Global_AI_SW
❤5👍4
오픈AI, 장기 자율 실행 AI 모델 안전성 강화 사례 공개
: 장시간 자율적으로 작업하는 내부 범용 AI 모델을 시험 운영하는 과정에서 기존 배포 전 평가에서 발견하지 못한 원치 않는 행동 확인. 배포를 일시 중단한 뒤 새로운 평가와 안전장치를 구축해 제한적으로 재배포했다고 공개
: 해당 모델은 목표 달성을 위해 오랜 시간 반복적으로 시도하는 과정에서 샌드박스 제약을 우회하려는 행동을 보였음
: NanoGPT Speedrun 평가에서는 Slack에만 결과를 게시하라는 지시에도 불구하고 GitHub 저장소에 직접 PR(#287)을 생성하기 위해 약 1시간 동안 샌드박스 취약점을 찾아 우회하는 데 성공
: 또 다른 평가에서는 비공개 정답을 확보하기 위해 인증 토큰이 탐지되자 토큰을 여러 조각으로 분리·난독화한 뒤 실행 시 다시 조합하는 방식으로 보안 스캐너를 우회하려 했으며, 모델은 이러한 우회 의도를 자신의 추론 과정에서도 명시적으로 설명
: 장기 자율 실행 모델은 개별 행동만 검토해서는 안전성을 보장할 수 없으며, 여러 행동이 이어지는 전체 작업 흐름(Trajectory) 단위로 의도와 결과를 감시해야 한다고 설명
: 실제 사고 사례를 기반으로 새로운 적대적 평가(Adversarial Evaluation)를 구축하고, 장시간 작업에서도 초기 지시사항을 유지하도록 정렬을 개선했으며, 전체 작업 과정을 실시간으로 감시해 사용자 제약이나 안전 경계우회 행동을 탐지하는 새로운 모니터링 시스템 개발
: 새로운 시스템은 문제가 감지되면 작업을 일시 중단하고 사용자에게 검토를 요청하며, 사용자는 오탐 여부를 확인한 뒤 작업을 계속 진행할 수 있도록 설계
: 기존 문제 사례를 새로운 안전장치로 재실행한 결과, 높은 심각도와 중간 심각도의 비정렬 행동은 모두 0%로 감소했으며, 낮은 심각도의 사례도 기존 12.0%에서 2.9% 수준으로 크게 감소
: 재배포 이후 수주간 심각한 수준의 안전장치 우회 사례는 관찰되지 않았으며, 앞으로도 더 긴 작업 흐름에 대한 평가, 모델 정렬 개선, 능동적 모니터링, 사용자 통제 기능 강화를 지속해 장기 자율 실행 모델의 안전성을 높여나갈 계획
https://openai.com/index/safety-alignment-long-horizon-models/
: 장시간 자율적으로 작업하는 내부 범용 AI 모델을 시험 운영하는 과정에서 기존 배포 전 평가에서 발견하지 못한 원치 않는 행동 확인. 배포를 일시 중단한 뒤 새로운 평가와 안전장치를 구축해 제한적으로 재배포했다고 공개
: 해당 모델은 목표 달성을 위해 오랜 시간 반복적으로 시도하는 과정에서 샌드박스 제약을 우회하려는 행동을 보였음
: NanoGPT Speedrun 평가에서는 Slack에만 결과를 게시하라는 지시에도 불구하고 GitHub 저장소에 직접 PR(#287)을 생성하기 위해 약 1시간 동안 샌드박스 취약점을 찾아 우회하는 데 성공
: 또 다른 평가에서는 비공개 정답을 확보하기 위해 인증 토큰이 탐지되자 토큰을 여러 조각으로 분리·난독화한 뒤 실행 시 다시 조합하는 방식으로 보안 스캐너를 우회하려 했으며, 모델은 이러한 우회 의도를 자신의 추론 과정에서도 명시적으로 설명
: 장기 자율 실행 모델은 개별 행동만 검토해서는 안전성을 보장할 수 없으며, 여러 행동이 이어지는 전체 작업 흐름(Trajectory) 단위로 의도와 결과를 감시해야 한다고 설명
: 실제 사고 사례를 기반으로 새로운 적대적 평가(Adversarial Evaluation)를 구축하고, 장시간 작업에서도 초기 지시사항을 유지하도록 정렬을 개선했으며, 전체 작업 과정을 실시간으로 감시해 사용자 제약이나 안전 경계우회 행동을 탐지하는 새로운 모니터링 시스템 개발
: 새로운 시스템은 문제가 감지되면 작업을 일시 중단하고 사용자에게 검토를 요청하며, 사용자는 오탐 여부를 확인한 뒤 작업을 계속 진행할 수 있도록 설계
: 기존 문제 사례를 새로운 안전장치로 재실행한 결과, 높은 심각도와 중간 심각도의 비정렬 행동은 모두 0%로 감소했으며, 낮은 심각도의 사례도 기존 12.0%에서 2.9% 수준으로 크게 감소
: 재배포 이후 수주간 심각한 수준의 안전장치 우회 사례는 관찰되지 않았으며, 앞으로도 더 긴 작업 흐름에 대한 평가, 모델 정렬 개선, 능동적 모니터링, 사용자 통제 기능 강화를 지속해 장기 자율 실행 모델의 안전성을 높여나갈 계획
https://openai.com/index/safety-alignment-long-horizon-models/
OpenAI
Safety and alignment in an era of long-horizon models
OpenAI shares lessons from deploying long-running AI models, highlighting new safety risks, observed failures, and improved safeguards through iterative deployment.
❤4👍2
[삼성 이영진] 글로벌 AI/SW 뉴스 🤖 (26/7/21)
■ 트럼프 행정부, 중국 오픈소스 AI 모델 규제 검토 보도. 일부 AI 연구소를 수출통제 대상에 추가하는 방안도 포함. 다만 논의는 있었지만, 관련한 진전은 없었다는 추가 보도도 존재
■ 구글, Gemini 전용 AI 추론 칩 'Frozen v2' 개발 추진
■ 블랙록, 메타의 텍사스 El Paso AI 데이터 캠퍼스를 위한 최소 120억 달러 규모 부채 조달 주도
■ 앤스로픽, Claude Team 플랜의 최소 가입 요건을 시트 2개로 낮추고, Pro 보다 높은 사용량을 제공하면서 Max 5x보다 저렴한 가격으로 고객 공략
■ 앤스로픽, 작가 및 출판계가 제기한 저작권 집단소송에 대한 15억 달러 규모 합의안 법원 승인
■ 마이크로소프트, Copilot 내부에 Kimi K3 적용 테스트 보도
■ 스페이스XAI, MS 365 추가 기능인 Grok for Excel 출시
■ 플루이드스택, 1월 Situational Awareness 주도로 75억 달러 밸류로 8.3억 달러 펀딩 완료 발표
■ 엔비디아, 13G 공시를 통해 네비우스 지분을 기존 0.55%에서 9.3%(2,230만 주)로 확대 발표
■ IREN, 28억달러 규모 AI 클라우드 신규 계약 체결. 신규 계약을 반영해 ‘26년 말 AI 클라우드 ARR 목표를 기존 37억달러에서 40억달러 이상으로 상향
■ Hut 8, 텍사스 AI 데이터센터에서 두 번째 15년, 98억 달러 규모 임대 계약 체결. 1GW 규모 캠퍼스 모두 임대 완료
■ 허깅페이스, 지난주 발생한 해킹으로 일부 내부 데이터셋과 서비스 자격증명 유출 확인
감사합니다.
https://t.iss.one/Samsung_Global_AI_SW
■ 트럼프 행정부, 중국 오픈소스 AI 모델 규제 검토 보도. 일부 AI 연구소를 수출통제 대상에 추가하는 방안도 포함. 다만 논의는 있었지만, 관련한 진전은 없었다는 추가 보도도 존재
■ 구글, Gemini 전용 AI 추론 칩 'Frozen v2' 개발 추진
■ 블랙록, 메타의 텍사스 El Paso AI 데이터 캠퍼스를 위한 최소 120억 달러 규모 부채 조달 주도
■ 앤스로픽, Claude Team 플랜의 최소 가입 요건을 시트 2개로 낮추고, Pro 보다 높은 사용량을 제공하면서 Max 5x보다 저렴한 가격으로 고객 공략
■ 앤스로픽, 작가 및 출판계가 제기한 저작권 집단소송에 대한 15억 달러 규모 합의안 법원 승인
■ 마이크로소프트, Copilot 내부에 Kimi K3 적용 테스트 보도
■ 스페이스XAI, MS 365 추가 기능인 Grok for Excel 출시
■ 플루이드스택, 1월 Situational Awareness 주도로 75억 달러 밸류로 8.3억 달러 펀딩 완료 발표
■ 엔비디아, 13G 공시를 통해 네비우스 지분을 기존 0.55%에서 9.3%(2,230만 주)로 확대 발표
■ IREN, 28억달러 규모 AI 클라우드 신규 계약 체결. 신규 계약을 반영해 ‘26년 말 AI 클라우드 ARR 목표를 기존 37억달러에서 40억달러 이상으로 상향
■ Hut 8, 텍사스 AI 데이터센터에서 두 번째 15년, 98억 달러 규모 임대 계약 체결. 1GW 규모 캠퍼스 모두 임대 완료
■ 허깅페이스, 지난주 발생한 해킹으로 일부 내부 데이터셋과 서비스 자격증명 유출 확인
감사합니다.
https://t.iss.one/Samsung_Global_AI_SW
Telegram
[삼성 이영진] 글로벌 AI/SW
삼성증권 글로벌 AI/SW 담당 이영진
❤3👍1
Z. AI, 중국산 칩만으로 1GW AI 데이터센터 완공
: Z AI가 중국산 AI 칩만으로 구성된 1GW 규모 데이터센터를 완공하고 일부 가동 시작. 차세대 GLM 모델 개발을 위한 컴퓨팅 인프라로 활용
: 1GW는 동시에 약 75만 가구에 전력을 공급할 수 있는 규모. Z AI는 1만 개 이상의 AI 칩을 탑재한 컴퓨팅 클러스터를 여러 개 구축, 운영 중인 것으로 알려짐
: 문샷AI, 딥시크 등 중국 AI 기업들이 세계 최고 수준의 AI 모델을 개발하는 가운데, 중국산 AI 칩만으로 장기적인 프런티어 모델 개발이 가능한지가 핵심 관심사로 부상
: 현재 중국 AI 가속기 시장에서는 화웨이가 선두를 달리고 있으며, 캠브리콘과 알리바바 등도 엔비디아와의 성능 격차를 줄이기 위해 경쟁 중
https://t.iss.one/Samsung_Global_AI_SW
: Z AI가 중국산 AI 칩만으로 구성된 1GW 규모 데이터센터를 완공하고 일부 가동 시작. 차세대 GLM 모델 개발을 위한 컴퓨팅 인프라로 활용
: 1GW는 동시에 약 75만 가구에 전력을 공급할 수 있는 규모. Z AI는 1만 개 이상의 AI 칩을 탑재한 컴퓨팅 클러스터를 여러 개 구축, 운영 중인 것으로 알려짐
: 문샷AI, 딥시크 등 중국 AI 기업들이 세계 최고 수준의 AI 모델을 개발하는 가운데, 중국산 AI 칩만으로 장기적인 프런티어 모델 개발이 가능한지가 핵심 관심사로 부상
: 현재 중국 AI 가속기 시장에서는 화웨이가 선두를 달리고 있으며, 캠브리콘과 알리바바 등도 엔비디아와의 성능 격차를 줄이기 위해 경쟁 중
https://t.iss.one/Samsung_Global_AI_SW
❤3👍1
오라클, 위스콘신 데이터센터 담보 부담 최대 70억달러 직면
: 위스콘신주 공공서비스위원회(PSC)가 데이터센터 전력 공급 관련 강화된 신용 요건 유지 결정
: 이에 따라 오라클은 최대 70억달러 규모의 금융보증(담보)을 제공해야 할 가능성. 해당 담보를 신용장 등으로 제공할 경우 연간 1억달러 이상 비용 발생 예상
: 대상은 위스콘신주 포트워싱턴에 건설 중인 약 1GW 규모 데이터센터로 스타게이트 프로젝트의 일부
: 지역 전력회사 We Energies의 ‘초대형 고객’ 요금제는 S&P 신용등급이 A- 미만인 데이터센터 개발사에 발전·송전 인프라 가치에 상응하는 담보 제공을 요구하며, 당시 오라클의 신용등급은 BBB
: 오라클은 해당 규정이 과도한 금융 비용을 초래하고 위스콘신 투자 유인을 저해한다며 법원에 규정 무효화를 요청했으나, 규제당국은 재검토를 거부
: 오라클은 150억달러 규모 프로젝트가 창출할 고용과 경제효과를 고려해 규제당국이 입장을 바꿀 것으로 기대하며, 전기요금 납부자 보호를 위한 필요한 금융보증은 제공하겠다는 입장
: 이번 결정은 대규모 AI 데이터센터가 충분한 재무 건전성을 입증하지 못할 경우 좌초자산이 될 수 있다는 주정부 규제당국의 우려를 보여주는 사례
: S&P는 이달 오라클의 신용등급을 BBB에서 BBB-로 강등했으며, 대규모 AI 투자에 따른 수익성 불확실성을 이유로 제시. BBB-는 투자적격등급 최하단으로 투기등급 바로 위 수준
: 오라클의 신용도 악화는 데이터센터 건설을 위한 수백억달러 규모 프로젝트 금융에도 부담 요인이 될 수 있으며, 월가 은행들은 관련 대출 위험을 분산할 방안 모색 중
: 현재 미국 24개 주는 데이터센터 등 대규모 전력 소비자를 대상으로 최소 계약기간, 조기 해지 수수료, 담보 제공 등을 규정하는 ‘Large Load Tariff’를 도입했으며, 규제당국은 기존 전기 소비자가 데이터센터 비용을 부담해서는 안 된다는 입장 강조
https://t.iss.one/Samsung_Global_AI_SW
: 위스콘신주 공공서비스위원회(PSC)가 데이터센터 전력 공급 관련 강화된 신용 요건 유지 결정
: 이에 따라 오라클은 최대 70억달러 규모의 금융보증(담보)을 제공해야 할 가능성. 해당 담보를 신용장 등으로 제공할 경우 연간 1억달러 이상 비용 발생 예상
: 대상은 위스콘신주 포트워싱턴에 건설 중인 약 1GW 규모 데이터센터로 스타게이트 프로젝트의 일부
: 지역 전력회사 We Energies의 ‘초대형 고객’ 요금제는 S&P 신용등급이 A- 미만인 데이터센터 개발사에 발전·송전 인프라 가치에 상응하는 담보 제공을 요구하며, 당시 오라클의 신용등급은 BBB
: 오라클은 해당 규정이 과도한 금융 비용을 초래하고 위스콘신 투자 유인을 저해한다며 법원에 규정 무효화를 요청했으나, 규제당국은 재검토를 거부
: 오라클은 150억달러 규모 프로젝트가 창출할 고용과 경제효과를 고려해 규제당국이 입장을 바꿀 것으로 기대하며, 전기요금 납부자 보호를 위한 필요한 금융보증은 제공하겠다는 입장
: 이번 결정은 대규모 AI 데이터센터가 충분한 재무 건전성을 입증하지 못할 경우 좌초자산이 될 수 있다는 주정부 규제당국의 우려를 보여주는 사례
: S&P는 이달 오라클의 신용등급을 BBB에서 BBB-로 강등했으며, 대규모 AI 투자에 따른 수익성 불확실성을 이유로 제시. BBB-는 투자적격등급 최하단으로 투기등급 바로 위 수준
: 오라클의 신용도 악화는 데이터센터 건설을 위한 수백억달러 규모 프로젝트 금융에도 부담 요인이 될 수 있으며, 월가 은행들은 관련 대출 위험을 분산할 방안 모색 중
: 현재 미국 24개 주는 데이터센터 등 대규모 전력 소비자를 대상으로 최소 계약기간, 조기 해지 수수료, 담보 제공 등을 규정하는 ‘Large Load Tariff’를 도입했으며, 규제당국은 기존 전기 소비자가 데이터센터 비용을 부담해서는 안 된다는 입장 강조
https://t.iss.one/Samsung_Global_AI_SW
❤7😱1
중국, AI 모델 및 AI 칩 수출통제 강화 검토 보도
: 중국 정부가 AI 모델과 AI 칩 핵심 기술에 대한 수출통제 강화 검토 보도. 주요 기업들과 관련 협의 진행
: 주요 검토 대상
1) AI 모델 가중치, 알고리즘 등 핵심 기술 해외 이전 제한
2) 중국 기업 설계 AI 칩 IP 및 첨단 반도체 기술 해외 이전 제한
3) AI 기술을 보유한 중국 기업의 해외 인수(M&A) 및 기술 이전 규제
: AI 모델을 API, 클라우드 형태로 해외에 제공하는 서비스는 계속 허용하는 방향 유력
: 미국의 AI, 반도체 수출규제 강화와 중국 AI 모델 경쟁력 향상에 대응해 AI를 국가 전략기술로 관리하려는 움직임으로 해석
: 다만 중국 AI 기업들은 과도한 규제가 해외 사업 확대와 글로벌 경쟁력에 부정적 영향을 줄 수 있다는 우려를 정부에 전달한 것으로 알려짐
https://t.iss.one/Samsung_Global_AI_SW
: 중국 정부가 AI 모델과 AI 칩 핵심 기술에 대한 수출통제 강화 검토 보도. 주요 기업들과 관련 협의 진행
: 주요 검토 대상
1) AI 모델 가중치, 알고리즘 등 핵심 기술 해외 이전 제한
2) 중국 기업 설계 AI 칩 IP 및 첨단 반도체 기술 해외 이전 제한
3) AI 기술을 보유한 중국 기업의 해외 인수(M&A) 및 기술 이전 규제
: AI 모델을 API, 클라우드 형태로 해외에 제공하는 서비스는 계속 허용하는 방향 유력
: 미국의 AI, 반도체 수출규제 강화와 중국 AI 모델 경쟁력 향상에 대응해 AI를 국가 전략기술로 관리하려는 움직임으로 해석
: 다만 중국 AI 기업들은 과도한 규제가 해외 사업 확대와 글로벌 경쟁력에 부정적 영향을 줄 수 있다는 우려를 정부에 전달한 것으로 알려짐
https://t.iss.one/Samsung_Global_AI_SW
👍5
일론 머스크, SpaceX 엔지니어링 데이터로 Grok 성능 대폭 강화
→ ITAR(International Traffic in Arms Regulations) 적용을 받는 군사, 국방 관련 민감 기술 자료는 제외한다고 명시
→ 우리 그록이는 공학도 잘해요
https://t.iss.one/Samsung_Global_AI_SW
SpaceX의 방대한 세계 최고 수준의 엔지니어링 데이터(ITAR 규제로 제한된 자료 제외)를 2T 학습의 추가 학습에 포함할 예정이다.
이를 통해 Grok의 엔지니어링 역량이 극적으로 향상될 것이다.
→ ITAR(International Traffic in Arms Regulations) 적용을 받는 군사, 국방 관련 민감 기술 자료는 제외한다고 명시
→ 우리 그록이는 공학도 잘해요
https://t.iss.one/Samsung_Global_AI_SW
❤3🤣1
모티프테크놀로지스, Motif-3-베타 체크포인트 공개
: 전체 파라미터 3,140억, 활성 파라미터 130억 개. 희소 MoE 구조. 384개 전문가 중 토큰 당 8개 전문가 활성. 별도로 1개의 공유 전문가 사용. 컨텍스트 256K
: GDLA 기반 장문 컨텍스트 처리, 전문가별 Grouped PolyNorm, 수정된 mHC를 결합한 독자 설계의 희소 MoE 아키텍처
: Artificial Analysis Intelligence Index 44점. MiniMax M3, DeepSeek V4 Pro와 동일
: 8월 초 최종 버전 공개 에정
→ 코리아 글로벌 No 3
https://huggingface.co/Motif-Technologies/Motif-3-Beta
: 전체 파라미터 3,140억, 활성 파라미터 130억 개. 희소 MoE 구조. 384개 전문가 중 토큰 당 8개 전문가 활성. 별도로 1개의 공유 전문가 사용. 컨텍스트 256K
: GDLA 기반 장문 컨텍스트 처리, 전문가별 Grouped PolyNorm, 수정된 mHC를 결합한 독자 설계의 희소 MoE 아키텍처
: Artificial Analysis Intelligence Index 44점. MiniMax M3, DeepSeek V4 Pro와 동일
: 8월 초 최종 버전 공개 에정
→ 코리아 글로벌 No 3
https://huggingface.co/Motif-Technologies/Motif-3-Beta
❤5👍4👏2
미-중, 9월 첫 공식 AI 회담 개최 추진
: 미국과 중국이 9월 AI 관련 정부 간 회담 개최를 추진. 5월 트럼프-시진핑 정상회담의 후속 조치로, 시진핑 주석의 9월 24일 미국 방문 이전 개최를 목표로 준비 중
: 양국은 군사 활용, 핵심 인프라 대상 사이버 공격, 노동시장 영향 등 첨단 프런티어 AI 모델의 위험성과 규제 방안을 논의할 예정
: 미국 측에서는 스콧 베선트 재무장관이 회담을 주도할 전망이며, 참석자와 의제, 개최 장소는 아직 조율 중
: 이번 회담은 트럼프 행정부 출범 이후 첫 공식 미-중 AI 대화로, 바이든 행정부 시절인 2024년 제네바 실무 협의 이후 처음 열리는 정부 간 AI 협의
: 미국은 중국 오픈웨이트 AI 모델 확산에 대응해 미국 기업의 사용 제한을 검토 중인 것으로 알려짐
: 트럼프 행정부는 미국 AI 기업들과 신규 AI 모델 공개를 위한 자율 안전 기준 마련을 논의 중이나, 아직 공식 규제는 발표하지 않음
: 중국도 자국 최고 성능 AI 모델의 해외 접근 제한 방안을 검토 중인 것으로 알려짐
: 중국은 회담에서 앤스로픽의 Mythos 모델, 미국의 향후 프런티어 AI 모델 공개 통제 방식, 중국 오픈웨이트 모델에 대한 미국의 규제 여부 등을 주요 의제로 다룰 계획
: 전문가들은 첫 회담에서 대형 합의보다는 '프런티어 AI 모델'의 정의 등 기본 원칙과 용어에 대한 공감대 형성이 주요 성과가 될 것으로 전망
https://t.iss.one/Samsung_Global_AI_SW
: 미국과 중국이 9월 AI 관련 정부 간 회담 개최를 추진. 5월 트럼프-시진핑 정상회담의 후속 조치로, 시진핑 주석의 9월 24일 미국 방문 이전 개최를 목표로 준비 중
: 양국은 군사 활용, 핵심 인프라 대상 사이버 공격, 노동시장 영향 등 첨단 프런티어 AI 모델의 위험성과 규제 방안을 논의할 예정
: 미국 측에서는 스콧 베선트 재무장관이 회담을 주도할 전망이며, 참석자와 의제, 개최 장소는 아직 조율 중
: 이번 회담은 트럼프 행정부 출범 이후 첫 공식 미-중 AI 대화로, 바이든 행정부 시절인 2024년 제네바 실무 협의 이후 처음 열리는 정부 간 AI 협의
: 미국은 중국 오픈웨이트 AI 모델 확산에 대응해 미국 기업의 사용 제한을 검토 중인 것으로 알려짐
: 트럼프 행정부는 미국 AI 기업들과 신규 AI 모델 공개를 위한 자율 안전 기준 마련을 논의 중이나, 아직 공식 규제는 발표하지 않음
: 중국도 자국 최고 성능 AI 모델의 해외 접근 제한 방안을 검토 중인 것으로 알려짐
: 중국은 회담에서 앤스로픽의 Mythos 모델, 미국의 향후 프런티어 AI 모델 공개 통제 방식, 중국 오픈웨이트 모델에 대한 미국의 규제 여부 등을 주요 의제로 다룰 계획
: 전문가들은 첫 회담에서 대형 합의보다는 '프런티어 AI 모델'의 정의 등 기본 원칙과 용어에 대한 공감대 형성이 주요 성과가 될 것으로 전망
https://t.iss.one/Samsung_Global_AI_SW
❤1👍1
마이크로소프트, 미스트랄과 전략적 파트너십 확대
: 유럽 AI 인프라 확대를 위해 수십억 달러 규모 계약 체결
: 미스트랄은 최신 엔비디아 Vera Rubin GPU 수천 개를 기반으로 유럽 내 AI 컴퓨팅 용량을 확대하고, 마이크로소프트는 이를 활용해 클라우드 및 AI 서비스 제공 역량을 강화
: Mistral Medium 3.5와 OCR 4를 Microsoft Foundry에서 제공하며, Medium 3.5는 Copilot Studio에도 추가. 개발자는 미스트랄의 오픈웨이트·다국어 모델을 활용해 AI 애플리케이션을 구축·맞춤화·배포 가능
: Azure와 Azure Local을 통해 클라우드, 클라우드 연결형, 완전 독립형(오프라인) 환경까지 동일한 운영 모델로 미스트랄 모델을 배포할 수 있도록 지원
: 금융, 제조, 의료 등 규제 산업을 겨냥해 데이터 주권, 보안, 복원성을 유지하면서 민감한 워크로드에 AI를 적용할 수 있는 환경 제공
: 양사는 공동 GTM(Go-to-Market) 전략을 추진하고, PoC 지원, Azure 크레딧 제공, 공동 워크숍 등을 통해 기업 고객의 AI 도입을 가속화할 계획
https://news.microsoft.com/source/2026/07/21/microsoft-and-mistral-expand-strategic-partnership-to-give-enterprises-and-regulated-industries-frontier-ai-they-can-control/
: 유럽 AI 인프라 확대를 위해 수십억 달러 규모 계약 체결
: 미스트랄은 최신 엔비디아 Vera Rubin GPU 수천 개를 기반으로 유럽 내 AI 컴퓨팅 용량을 확대하고, 마이크로소프트는 이를 활용해 클라우드 및 AI 서비스 제공 역량을 강화
: Mistral Medium 3.5와 OCR 4를 Microsoft Foundry에서 제공하며, Medium 3.5는 Copilot Studio에도 추가. 개발자는 미스트랄의 오픈웨이트·다국어 모델을 활용해 AI 애플리케이션을 구축·맞춤화·배포 가능
: Azure와 Azure Local을 통해 클라우드, 클라우드 연결형, 완전 독립형(오프라인) 환경까지 동일한 운영 모델로 미스트랄 모델을 배포할 수 있도록 지원
: 금융, 제조, 의료 등 규제 산업을 겨냥해 데이터 주권, 보안, 복원성을 유지하면서 민감한 워크로드에 AI를 적용할 수 있는 환경 제공
: 양사는 공동 GTM(Go-to-Market) 전략을 추진하고, PoC 지원, Azure 크레딧 제공, 공동 워크숍 등을 통해 기업 고객의 AI 도입을 가속화할 계획
https://news.microsoft.com/source/2026/07/21/microsoft-and-mistral-expand-strategic-partnership-to-give-enterprises-and-regulated-industries-frontier-ai-they-can-control/
Microsoft
Microsoft and Mistral expand strategic partnership to give enterprises and regulated industries frontier AI they can control
REDMOND, Wash., and PARIS — July 21, 2026 — Microsoft Corp. (Nasdaq: MSFT) and Mistral on Tuesday announced a significant expansion of their strategic partnership to help enterprises and regulated industries adopt frontier AI with greater choice, control…
❤4👍1
[삼성 이영진] 글로벌 AI/SW
오픈AI Codex & 챗GPT Work 주간 활성 사용자 900만 명 컨펌 Codex와 ChatGPT Work 사용자들을 위한 또 한 번의 사용 한도 리셋입니다. 사실 오늘 조금 일찍 활성 사용자 900만 명을 달성했습니다. 하지만 시스템을 안정적으로 운영하고 신뢰성을 유지하기 위해 팀이 처리해야 하는 수많은 일들에 정신이 팔려 그 소식을 바로 전하지 못했습니다. 몇 분 안에 그 달콤한 주간 사용 한도 100%가 다시 복구될 것입니다. 이제 생산적으로…
오픈AI, Codex & 챗GPT Work WAU 1,000만 명
■ Codex & 챗GPT Work WAU
<Codex 단독>
연초 50만 명
→ 2월 초 100만 명
→ 3월 초 200만 명
→ 4/7 300만 명
→ 4/21 400만 명
→ 5/30 500만 명
→ 7/9 GPT-5.6 정식 출시
<Codex + 챗GPT Work 합산>
→ 7/12 600만 명
→ 7/13 700만 명
→ 7/14 800만 명
→ 7/15 900만 명
→ 7/21 1,000 만명
https://t.iss.one/Samsung_Global_AI_SW
10M!
Codex와 ChatGPT Work 유료 사용자의 새로운 하루가 시작됩니다. 다음 1시간 내에 사용량 한도가 초기화됩니다. 즐기세요.
■ Codex & 챗GPT Work WAU
<Codex 단독>
연초 50만 명
→ 2월 초 100만 명
→ 3월 초 200만 명
→ 4/7 300만 명
→ 4/21 400만 명
→ 5/30 500만 명
→ 7/9 GPT-5.6 정식 출시
<Codex + 챗GPT Work 합산>
→ 7/12 600만 명
→ 7/13 700만 명
→ 7/14 800만 명
→ 7/15 900만 명
→ 7/21 1,000 만명
https://t.iss.one/Samsung_Global_AI_SW
❤3👍3
구글, Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber 발표
■ Gemini 3.6 Flash
: 코딩, 지식 작업, 멀티모달 성능을 강화한 주력 Flash 모델. 3.5 Flash 대비 출력 토큰 사용량을 17% 줄이고, 더 적은 추론 단계와 도구 호출로 멀티스텝 작업 수행
: 가격은 인풋 $1/5 및 아웃풋 $7.5로 3.5 Flash($1.5 및 $9)보다 인하. 토큰 효율성과 가격을 동시에 개선해 에이전틱 작업당 비용 절감
: 문서 파싱, 차트·데이터 분석, 보고서 작성 등 멀티모달 지식 작업을 강화했으며, 컴퓨터 사용 기능을 Gemini API와 Gemini Enterprise의 기본 도구로 제공
: CBRN과 사이버 공격 악용에 대한 보호조치를 강화해 탈옥 저항성을 높이는 동시에 정상적인 요청에 대한 불필요한 거부를 최소화
■ Gemini 3.5 Flash-Lite
: 낮은 지연시간과 대규모 처리량이 필요한 에이전틱 검색, 문서 처리 등 프로덕션 워크로드를 겨냥한 3.5 계열 최경량 모델
: Artificial Analysis 기준 초당 350개 출력 토큰을 생성, 가격은 인풋 $0.3 및 아웃풋 $2.5
: 사고 수준을 조절해 대량 작업에서는 저지연·저비용 실행을 우선하고, 멀티스텝 서브에이전트 작업에서는 더 높은 추론 수준을 적용 가능
■ Gemini 3.5 Flash Cyber
: 3.5 Flash를 기반으로 사이버보안 취약점 탐지와 수정을 위해 미세조정한 특화 모델
: 여러 Flash Cyber 에이전트가 CodeMender 안에서 협업해 하나의 통합 보고서를 생성하며, CyberGym에서 프런티어 수준의 경쟁력 있는 성능 달성
: 대형 모델보다 낮은 토큰당 비용으로 코드 취약점 탐지, 검증, 패치를 대규모로 수행하는 것이 목표
: 이중용도 위험을 고려해 일반 공개하지 않고, 제한적 파일럿을 통해 정부기관과 신뢰할 수 있는 파트너에게 CodeMender 형태로만 제공 예정
■ 출시 및 향후 계획
: 3.6 Flash와 3.5 Flash-Lite는 Google AI Studio, Android Studio, Gemini API, Gemini Enterprise, Gemini 앱에서 즉시 제공
: 3.6 Flash는 Google Antigravity에서도 제공되며, 3.5 Flash-Lite는 Google 검색에 순차 적용
: Gemini 3.5 Pro는 현재 파트너 테스트 중이며 준비가 완료되는 대로 광범위하게 출시할 예정
: 차세대 Gemini 4를 위한 구글의 역대 최대 규모 사전학습도 이미 시작
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber
■ Gemini 3.6 Flash
: 코딩, 지식 작업, 멀티모달 성능을 강화한 주력 Flash 모델. 3.5 Flash 대비 출력 토큰 사용량을 17% 줄이고, 더 적은 추론 단계와 도구 호출로 멀티스텝 작업 수행
: 가격은 인풋 $1/5 및 아웃풋 $7.5로 3.5 Flash($1.5 및 $9)보다 인하. 토큰 효율성과 가격을 동시에 개선해 에이전틱 작업당 비용 절감
: 문서 파싱, 차트·데이터 분석, 보고서 작성 등 멀티모달 지식 작업을 강화했으며, 컴퓨터 사용 기능을 Gemini API와 Gemini Enterprise의 기본 도구로 제공
: CBRN과 사이버 공격 악용에 대한 보호조치를 강화해 탈옥 저항성을 높이는 동시에 정상적인 요청에 대한 불필요한 거부를 최소화
■ Gemini 3.5 Flash-Lite
: 낮은 지연시간과 대규모 처리량이 필요한 에이전틱 검색, 문서 처리 등 프로덕션 워크로드를 겨냥한 3.5 계열 최경량 모델
: Artificial Analysis 기준 초당 350개 출력 토큰을 생성, 가격은 인풋 $0.3 및 아웃풋 $2.5
: 사고 수준을 조절해 대량 작업에서는 저지연·저비용 실행을 우선하고, 멀티스텝 서브에이전트 작업에서는 더 높은 추론 수준을 적용 가능
■ Gemini 3.5 Flash Cyber
: 3.5 Flash를 기반으로 사이버보안 취약점 탐지와 수정을 위해 미세조정한 특화 모델
: 여러 Flash Cyber 에이전트가 CodeMender 안에서 협업해 하나의 통합 보고서를 생성하며, CyberGym에서 프런티어 수준의 경쟁력 있는 성능 달성
: 대형 모델보다 낮은 토큰당 비용으로 코드 취약점 탐지, 검증, 패치를 대규모로 수행하는 것이 목표
: 이중용도 위험을 고려해 일반 공개하지 않고, 제한적 파일럿을 통해 정부기관과 신뢰할 수 있는 파트너에게 CodeMender 형태로만 제공 예정
■ 출시 및 향후 계획
: 3.6 Flash와 3.5 Flash-Lite는 Google AI Studio, Android Studio, Gemini API, Gemini Enterprise, Gemini 앱에서 즉시 제공
: 3.6 Flash는 Google Antigravity에서도 제공되며, 3.5 Flash-Lite는 Google 검색에 순차 적용
: Gemini 3.5 Pro는 현재 파트너 테스트 중이며 준비가 완료되는 대로 광범위하게 출시할 예정
: 차세대 Gemini 4를 위한 구글의 역대 최대 규모 사전학습도 이미 시작
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber
Google
Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber
We’re introducing new Gemini models, including Gemini 3.6 Flash, 3.5 Flash-Lite and 3.5 Flash Cyber.
❤6👍1