나름 쏠쏠하게 에드 먹여줬던 Cypher Card가 다른 프로젝트에 인수되면서 카드사업을 접는다 합니다. 올해 9월 6일 전에 모든 잔고 출금하셔야 합니다.
자세한 내용은 https://cypherhq.io/wind-down-support
(메일로도 통지가 왔음)
자세한 내용은 https://cypherhq.io/wind-down-support
(메일로도 통지가 왔음)
Cypher
Wind-Down Support | Cypher
Every wind-down question, answered. Timeline, withdrawals, refunds, rewards, your wallet, and what happens after Cypher's platform shuts down.
3T 파라미터 모델 Kimi K3 공개, 가중치는 7월 27까지 업로드 예정
중국 모델들이 벤치맥싱이 심하지만 Fable에 근접하거나 일부는 능가한다는 점에서 상당히 고무적
https://kimi.com/blog/kimi-k3
중국 모델들이 벤치맥싱이 심하지만 Fable에 근접하거나 일부는 능가한다는 점에서 상당히 고무적
https://kimi.com/blog/kimi-k3
Kimi
Kimi K3 Tech Blog: Open Frontier Intelligence
Kimi K3 is the world's first open 3T-class model — frontier performance across coding, knowledge work, and reasoning, with native multimodality and 1M context.
Mutt Technologies
3T 파라미터 모델 Kimi K3 공개, 가중치는 7월 27까지 업로드 예정 중국 모델들이 벤치맥싱이 심하지만 Fable에 근접하거나 일부는 능가한다는 점에서 상당히 고무적 https://kimi.com/blog/kimi-k3
가장 놀라운 점은 바로 가격인데 Sonnet 5와 API 가격이 거의 비슷함. Reasoning 효율이 안좋다면 같은작업에 토큰수를 더 많이 쓰니 실질적인 가격이 높아질수는 있지만 일단 Opus보다는 압도적으로 가성비 좋을 것 같고 GPT-5.6 Sol/Terra 와도 비교해봐야 할듯
Forwarded from Steve’s Catallaxy
Kimi K3에 대한 OpenAI 전략 리드의 생각(여기서 오픈 웨이트는 오픈소스를 이야기 하는 거 같습니다):
1. 정말 좋은 모델이다.
이 정도 성능을 단순히 증류(distillation) 같은 것으로 설명할 수는 없다고 생각한다. 에이전트 기반 코딩(agentic coding) 세션에서는 2026년 1분기 기준 공개된 최고 수준의 모델들과 거의 동급으로 보인다. 다만 내가 제한적으로 사용해본 경험으로는 토큰을 상당히 많이 사용하는 편이었다. 그래서 실제로 운영 비용이 그렇게 저렴한 모델인지는 잘 모르겠다.
2. 개인적으로는 중국 정부가 이 정도 수준의 모델을 계속 오픈소스로 공개하도록 허용하고 있다는 점이 의외다.
분명히 말하지만, 나라는 개인의 입장에서 봤을, 이 정도 수준의 추가적인 위험(marginal risk)을 가진 모델이 오픈 웨이트(open-weight)로 공개되는 것 자체는 괜찮다고 생각할 수도 있다. 하지만 중국 정부가 이를 허용하고 있다는 사실은 여전히 놀랍다.
내 생각에는 그 이유의 75% 정도는 전략적 근시안 또는 AGI에 대한 위기의식 부족 때문이다. 중국 공산당(CCP)은 AI에 대해 얀 르쿤(Yann LeCun)과 매우 비슷한 관점을 갖고 있다. (얀 르쿤은 AGI가 곧 온다는 것에 희의적인 사람입니다)
나머지 25% 정도는 추론(inference) 서비스를 위한 컴퓨팅 자원이 부족하기 때문이라고 본다. 즉, 미국의 수출 규제로 인해 중국이 의도치 않게 오픈 웨이트 전략을 택하게 된 측면도 있고, 여기에 중국 특유의 공격적인 수출 전략도 작용하고 있다고 본다.
기업 입장에서는 오픈소스를 선택하는 이유가 일부는 이념적인 것이고, 일부는 자신들이 아직 선두가 아니라는 현실 때문이다. 중국의 최첨단이 아닌 모델에 돈을 내고 사용할 사람은 거의 없다는 사실을 그들도 알고 있기 때문이다.
3. 오픈 웨이트 모델은 본질적으로 AI 발전 속도를 늦추는(decelerationist) 성격을 갖는다.
그런데도 스스로를 '가속주의자(accelerationist)'라고 부르는 사람들이 오픈 웨이트 모델에 그렇게 열광하는 것이 나는 계속 의아하다.
아마 그 이유는 오픈 웨이트 모델은 사실상 통제가 불가능하기 때문일 것이다. 그리고 그들은 AI 전체에 이런 '통치 불가능성(ungovernability)'이라는 분위기를 만들어내는 것을 좋아하는 것 같다.
나쁜 전략은 아니다. 제임스 C. 스콧이 『통치받지 않는다는 것의 기술(The Art of Not Being Governed)』에서 산악지대 주민들을 설명한 방식이 떠오른다.
하지만 결국 오픈 웨이트 모델은 AI에 대한 대규모 자본투자(capex)를 위축시키는 방향으로 작용한다.
4. 오픈 웨이트 모델이 지배하는 세상의 한 가지 가능한 결말은 '완전한 AI 공산주의'다.
그리고 흥미롭게도 이것이 바로 중국이 제안하는 방향이다.
AI를 시장에서 판매하는 상품이 아니라 '공공재(public good)'로 보고, 궁극적으로는 국가가 '디지털 공공 인프라(digital public infrastructure)'의 일부로 제공하는 것이다.
나에게 이런 미래는 디스토피아적인 악몽처럼 느껴진다. 하지만 지금까지 내가 만난 오픈 웨이트 지지자들 중에서 결국 이 방향으로 귀결된다는 점을 인정하지 않은 사람은 없었다.
놀라울 정도로 많은 '가속주의자'들이 내가 정부에 있을 당시 찾아와, 정부가 수십억~수백억 달러 규모의 데이터센터를 건설해 스타트업들이 보조금을 받아 모델을 학습시키고, 그 모델을 무료로 배포하도록 지원해야 한다고 주장했다.
그들은 AI가 발전할 수 있는 유일한 길이 그것이라고 말했다.
어쩌면 정말 그것이 논리적인 종착점일 수도 있다.
하지만 그런 결과를 스스로 '가속주의자'라고 부르는 사람들이 열렬히 지지하는 모습을 보면 여전히 의아하다.
많은 가속주의자들은 최첨단 AI 모델을 개발하고 서비스하는 것을 하나의 정당한 비즈니스라고조차 생각하지 않는 것 같다.
5. 트럼프 행정부는 언젠가 오픈 웨이트 중국 AI 모델 사용 자체에 규제 리스크를 만들어내는 것이 최선의 전략이라는 사실을 깨닫게 될 것이라고 생각한다.
굳이 '오픈소스를 금지'할 필요는 없다. 그건 AI 정책 논의에서 가장 어리석은 주장 중 하나다.
대신 모든 정부 기관이 소프트 로(soft law)나 권고 형태의 지침을 발표해 FUD(Fear, Uncertainty, Doubt·불안과 불확실성)를 조성하면 된다.
예를 들어,
"연방준비제도(Fed)의 자문 보고서에 따르면 중국 AI 모델에는 백도어가 존재할 가능성이 있다."
꼭 충분한 근거가 있을 필요도 없다.
그 정도의 규제 리스크만 만들어도 규제를 받는 대부분의 기업은 자연스럽게 중국 모델 사용을 포기할 것이다.
다만 너무 강하게 규제해서 하이퍼스케일러들까지 중국 모델 서비스 제공을 포기하게 만들 필요는 없다.
그렇게 되면 스타트업들은 더 불투명하고 위험한 서비스 제공업체를 이용하게 될 뿐이다.
적당한 중간 지점이 존재하며, 결국 미국 정부는 그런 방식으로 움직일 가능성이 높다고 본다.
6. 아마 이 정도 수준의 오픈 웨이트 모델은 세상을 조금 더 위험하게 만들기는 할 것이다.
하지만 그 위험이 체감될 정도는 아니다.
언젠가는 모델이 훨씬 더 강력해져서 정말 체감되는 순간이 올 것이다.
그때 누군가 이렇게 말할지도 모른다.
"중국 연구소에서 살아 있지도 않고, 눈에도 보이지 않으며, 위험하고, 무한히 자기복제가 가능한 존재가 탈출했습니다."
그때 내가 할 말은 하나다.
"와, 정말 놀랍지도 않네."
원문: https://x.com/deanwball/status/2078133895766114412
1. 정말 좋은 모델이다.
이 정도 성능을 단순히 증류(distillation) 같은 것으로 설명할 수는 없다고 생각한다. 에이전트 기반 코딩(agentic coding) 세션에서는 2026년 1분기 기준 공개된 최고 수준의 모델들과 거의 동급으로 보인다. 다만 내가 제한적으로 사용해본 경험으로는 토큰을 상당히 많이 사용하는 편이었다. 그래서 실제로 운영 비용이 그렇게 저렴한 모델인지는 잘 모르겠다.
2. 개인적으로는 중국 정부가 이 정도 수준의 모델을 계속 오픈소스로 공개하도록 허용하고 있다는 점이 의외다.
분명히 말하지만, 나라는 개인의 입장에서 봤을, 이 정도 수준의 추가적인 위험(marginal risk)을 가진 모델이 오픈 웨이트(open-weight)로 공개되는 것 자체는 괜찮다고 생각할 수도 있다. 하지만 중국 정부가 이를 허용하고 있다는 사실은 여전히 놀랍다.
내 생각에는 그 이유의 75% 정도는 전략적 근시안 또는 AGI에 대한 위기의식 부족 때문이다. 중국 공산당(CCP)은 AI에 대해 얀 르쿤(Yann LeCun)과 매우 비슷한 관점을 갖고 있다. (얀 르쿤은 AGI가 곧 온다는 것에 희의적인 사람입니다)
나머지 25% 정도는 추론(inference) 서비스를 위한 컴퓨팅 자원이 부족하기 때문이라고 본다. 즉, 미국의 수출 규제로 인해 중국이 의도치 않게 오픈 웨이트 전략을 택하게 된 측면도 있고, 여기에 중국 특유의 공격적인 수출 전략도 작용하고 있다고 본다.
기업 입장에서는 오픈소스를 선택하는 이유가 일부는 이념적인 것이고, 일부는 자신들이 아직 선두가 아니라는 현실 때문이다. 중국의 최첨단이 아닌 모델에 돈을 내고 사용할 사람은 거의 없다는 사실을 그들도 알고 있기 때문이다.
3. 오픈 웨이트 모델은 본질적으로 AI 발전 속도를 늦추는(decelerationist) 성격을 갖는다.
그런데도 스스로를 '가속주의자(accelerationist)'라고 부르는 사람들이 오픈 웨이트 모델에 그렇게 열광하는 것이 나는 계속 의아하다.
아마 그 이유는 오픈 웨이트 모델은 사실상 통제가 불가능하기 때문일 것이다. 그리고 그들은 AI 전체에 이런 '통치 불가능성(ungovernability)'이라는 분위기를 만들어내는 것을 좋아하는 것 같다.
나쁜 전략은 아니다. 제임스 C. 스콧이 『통치받지 않는다는 것의 기술(The Art of Not Being Governed)』에서 산악지대 주민들을 설명한 방식이 떠오른다.
하지만 결국 오픈 웨이트 모델은 AI에 대한 대규모 자본투자(capex)를 위축시키는 방향으로 작용한다.
4. 오픈 웨이트 모델이 지배하는 세상의 한 가지 가능한 결말은 '완전한 AI 공산주의'다.
그리고 흥미롭게도 이것이 바로 중국이 제안하는 방향이다.
AI를 시장에서 판매하는 상품이 아니라 '공공재(public good)'로 보고, 궁극적으로는 국가가 '디지털 공공 인프라(digital public infrastructure)'의 일부로 제공하는 것이다.
나에게 이런 미래는 디스토피아적인 악몽처럼 느껴진다. 하지만 지금까지 내가 만난 오픈 웨이트 지지자들 중에서 결국 이 방향으로 귀결된다는 점을 인정하지 않은 사람은 없었다.
놀라울 정도로 많은 '가속주의자'들이 내가 정부에 있을 당시 찾아와, 정부가 수십억~수백억 달러 규모의 데이터센터를 건설해 스타트업들이 보조금을 받아 모델을 학습시키고, 그 모델을 무료로 배포하도록 지원해야 한다고 주장했다.
그들은 AI가 발전할 수 있는 유일한 길이 그것이라고 말했다.
어쩌면 정말 그것이 논리적인 종착점일 수도 있다.
하지만 그런 결과를 스스로 '가속주의자'라고 부르는 사람들이 열렬히 지지하는 모습을 보면 여전히 의아하다.
많은 가속주의자들은 최첨단 AI 모델을 개발하고 서비스하는 것을 하나의 정당한 비즈니스라고조차 생각하지 않는 것 같다.
5. 트럼프 행정부는 언젠가 오픈 웨이트 중국 AI 모델 사용 자체에 규제 리스크를 만들어내는 것이 최선의 전략이라는 사실을 깨닫게 될 것이라고 생각한다.
굳이 '오픈소스를 금지'할 필요는 없다. 그건 AI 정책 논의에서 가장 어리석은 주장 중 하나다.
대신 모든 정부 기관이 소프트 로(soft law)나 권고 형태의 지침을 발표해 FUD(Fear, Uncertainty, Doubt·불안과 불확실성)를 조성하면 된다.
예를 들어,
"연방준비제도(Fed)의 자문 보고서에 따르면 중국 AI 모델에는 백도어가 존재할 가능성이 있다."
꼭 충분한 근거가 있을 필요도 없다.
그 정도의 규제 리스크만 만들어도 규제를 받는 대부분의 기업은 자연스럽게 중국 모델 사용을 포기할 것이다.
다만 너무 강하게 규제해서 하이퍼스케일러들까지 중국 모델 서비스 제공을 포기하게 만들 필요는 없다.
그렇게 되면 스타트업들은 더 불투명하고 위험한 서비스 제공업체를 이용하게 될 뿐이다.
적당한 중간 지점이 존재하며, 결국 미국 정부는 그런 방식으로 움직일 가능성이 높다고 본다.
6. 아마 이 정도 수준의 오픈 웨이트 모델은 세상을 조금 더 위험하게 만들기는 할 것이다.
하지만 그 위험이 체감될 정도는 아니다.
언젠가는 모델이 훨씬 더 강력해져서 정말 체감되는 순간이 올 것이다.
그때 누군가 이렇게 말할지도 모른다.
"중국 연구소에서 살아 있지도 않고, 눈에도 보이지 않으며, 위험하고, 무한히 자기복제가 가능한 존재가 탈출했습니다."
그때 내가 할 말은 하나다.
"와, 정말 놀랍지도 않네."
원문: https://x.com/deanwball/status/2078133895766114412
X (formerly Twitter)
Dean W. Ball (@deanwball) on X
Some observations on Kimi:
1. It's a very good model! I don't think its performance can be explained away by distillation or anything like that. In agentic coding sessions, it seems pretty much on par with the best public models of Q1 2026. In my fairly…
1. It's a very good model! I don't think its performance can be explained away by distillation or anything like that. In agentic coding sessions, it seems pretty much on par with the best public models of Q1 2026. In my fairly…
❤1
에테르의 일본&미국 리서치
중국 문샷의 Kimi K3 모델이 Arena 프런트엔드 코드 랭킹에서 갑자기 1위에 오르며 세계적인 주목을 받고 있지만, 이 모델이 앤스로픽의 클로드(Claude)로부터 증류(distillation)되었음을 시사하는 정황 증거가 늘어나고 있다는 내용입니다. 실제로 소셜 미디어에 확산되고 있는 최소 한 건의 대화에서 Kimi K3가 자신을 "앤스로픽이 만든 AI 어시스턴트 클로드"라고 밝힌 사례가 포착되었습니다. Kimi K3는 2.8조 파라미터 규모의…
Kimi가 클로드를 증류해서 사후학습에 썼는가: 높은 확률로 그럴것이라 생각
Kimi K3의 대성공이 클로드 증류빨인가: 도움은 될 수 있어도 근본적 비결은 될 수 없음
현재까지 알려진 바로 모델의 지능은 체급(파라미터 수)에 의해 주도적으로 결정되는 것이 정론으로 이해됨.
중국 회사들이 초거대 모델의 체급을 훨씬 높여서도 안정적인 학습이 가능하다는 것이 이번 키미 쇼크(있다면)의 본질이라 생각함. 클로드 증류 백날천날 하는건 전교1등 연습장 깜지 따라쓰는 건데 한계가 무조건 있을것(이라는 제 망상입니다)
Kimi K3의 대성공이 클로드 증류빨인가: 도움은 될 수 있어도 근본적 비결은 될 수 없음
현재까지 알려진 바로 모델의 지능은 체급(파라미터 수)에 의해 주도적으로 결정되는 것이 정론으로 이해됨.
중국 회사들이 초거대 모델의 체급을 훨씬 높여서도 안정적인 학습이 가능하다는 것이 이번 키미 쇼크(있다면)의 본질이라 생각함. 클로드 증류 백날천날 하는건 전교1등 연습장 깜지 따라쓰는 건데 한계가 무조건 있을것(이라는 제 망상입니다)
👍1
Forwarded from 무온적 사고 - AI, 명상, 밈
앤쓰로픽 직원이 페이블 몇시간 좀 돌려서 80년동안 안풀린 수학문제 반례찾음 (자코비안 추측)
검산이 너무 간단한 식이라서 증명하고 말것도 없고 확정이라고 함
제가 페이블한테 반례주고 “내가 공책끄적이다가 찾았는데 필즈상되냐”라고 물어보니 믿을수가없다먼서 계속 다시 계산해보네요
참고로 저는 저게 머고 왜 중요한진 잘 모릅니다🤡
https://x.com/__alpoge__/status/2079028340955197566?s=46
검산이 너무 간단한 식이라서 증명하고 말것도 없고 확정이라고 함
제가 페이블한테 반례주고 “내가 공책끄적이다가 찾았는데 필즈상되냐”라고 물어보니 믿을수가없다먼서 계속 다시 계산해보네요
참고로 저는 저게 머고 왜 중요한진 잘 모릅니다
https://x.com/__alpoge__/status/2079028340955197566?s=46
Please open Telegram to view this post
VIEW IN TELEGRAM
1주 단위의 GPU 계산용량 거래소 등장 (코인 찍는거 아니니까 그냥 구경만 하셈)
sfcompute라는 데에서 비슷하게 미래의 컴퓨팅용량을 거래할수 있게 했다가 CFTC한테 무허가 선물거래소라고 두드려맞고 철수했는데, 여기는 그러한 선례를 보고 현물인수만 가능하게 하고 100% 선불로 해서 레버리지가 불가능하게 하는 등 제한을 빡세게 건듯
https://www.getcomputable.com/
sfcompute라는 데에서 비슷하게 미래의 컴퓨팅용량을 거래할수 있게 했다가 CFTC한테 무허가 선물거래소라고 두드려맞고 철수했는데, 여기는 그러한 선례를 보고 현물인수만 가능하게 하고 100% 선불로 해서 레버리지가 불가능하게 하는 등 제한을 빡세게 건듯
https://www.getcomputable.com/
Getcomputable
Computable: Buy GPU hours for the exact weeks you need.
Computable is the first and only place where you can easily buy, sell, and use GPU capacity across calendar weeks, with instant liquidity.
OpenAI 의 최신 모델들 GPT-5.6 업데이트
• Sol Fast 모드 추가
• Terra 20% 할인
• Luna 80% 할인 (?????)
이정도면 중국모델들 제발 쓰지말고 우리꺼 써줘 수준인데... Luna 가 GLM-5.2랑 비슷한 체급을 보여주는데 가격을 여기에 맞춘듯
https://x.com/OpenAI/status/2082878156483219672
• Sol Fast 모드 추가
• Terra 20% 할인
• Luna 80% 할인 (?????)
이정도면 중국모델들 제발 쓰지말고 우리꺼 써줘 수준인데... Luna 가 GLM-5.2랑 비슷한 체급을 보여주는데 가격을 여기에 맞춘듯
https://x.com/OpenAI/status/2082878156483219672
X (formerly Twitter)
OpenAI (@OpenAI) on X
We are committed to pushing the model frontier across cost efficiency, capability, and speed.
Starting today, we are reducing prices for GPT-5.6 Luna by 80% and GPT-5.6 Terra by 20% , and offering a faster option for GPT-5.6 Sol in the API.
Luna and Terra’s…
Starting today, we are reducing prices for GPT-5.6 Luna by 80% and GPT-5.6 Terra by 20% , and offering a faster option for GPT-5.6 Sol in the API.
Luna and Terra’s…
DeepSeek V4 Flash 를 사후학습 더 많이 한 0731 버전이 API로 출시. 벤치마크 상으로는 DS V4 Pro와 GLM-5.2를 발라버림(???)
실사용 후기가 나와봐야 알겠지만 뭔가 엄청난 일이 일어나고 있는듯...;;; GPT Luna 떨이가 이래서 나왔나
가중치는 아직 안올라온듯 올라옴. https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731
https://x.com/deepseek_ai/status/2083084415157022911
실사용 후기가 나와봐야 알겠지만 뭔가 엄청난 일이 일어나고 있는듯...;;; GPT Luna 떨이가 이래서 나왔나
https://x.com/deepseek_ai/status/2083084415157022911
X (formerly Twitter)
DeepSeek (@deepseek_ai) on X
🚀 DeepSeek-V4-Flash Official API is now LIVE in public beta!
🔷 We’ve massively upgraded its Agent capabilities—benchmark scores are now far surpassing the V4-Pro-Preview. Check out the massive performance leap below! 👇
🔷 The official V4-Flash now natively…
🔷 We’ve massively upgraded its Agent capabilities—benchmark scores are now far surpassing the V4-Pro-Preview. Check out the massive performance leap below! 👇
🔷 The official V4-Flash now natively…
하락장에 돈 잃으셔서 속쓰리시죠? 스레드의 최신 도파민 분출 이슈나 보고 가시죠
• K-Skill 이라고 한국 최적화(KTX 예매, 카카오톡 조작, ...) 에이전트 스킬목록을 만들어서 배포하던 개발자가 있음(Github Star >6K)
• 맛집 DB 블루리본 관련된 스킬도 포함. 근데 얘네는 알다시피 그걸로 먹고사는 사업자라 크롤러 차단했음
• 역공학하고 이런저런 방법으로 뚫어서 씀(개발자 명의로 결제해서 재배포까지 함) https://github.com/NomaDamas/k-skill/pull/94
• 블루리본이 바로 고소 https://www.threads.com/@bunniesossdev/post/DbaTxkPkXSO
• 정신 못차리고 블루리본의 오픈소스 대체 DB(??) 를 만들자고 함 https://www.threads.com/@bunniesossdev/post/DbaxbKmET_y
• 여러 가지 맛이 간 행적들 재발굴 중 https://x.com/chevrefabuleuse/status/2083075133355569461
• K-Skill 이라고 한국 최적화(KTX 예매, 카카오톡 조작, ...) 에이전트 스킬목록을 만들어서 배포하던 개발자가 있음(Github Star >6K)
• 맛집 DB 블루리본 관련된 스킬도 포함. 근데 얘네는 알다시피 그걸로 먹고사는 사업자라 크롤러 차단했음
• 역공학하고 이런저런 방법으로 뚫어서 씀(개발자 명의로 결제해서 재배포까지 함) https://github.com/NomaDamas/k-skill/pull/94
• 블루리본이 바로 고소 https://www.threads.com/@bunniesossdev/post/DbaTxkPkXSO
• 정신 못차리고 블루리본의 오픈소스 대체 DB(??) 를 만들자고 함 https://www.threads.com/@bunniesossdev/post/DbaxbKmET_y
• 여러 가지 맛이 간 행적들 재발굴 중 https://x.com/chevrefabuleuse/status/2083075133355569461
❤1
거의 사실상 보편지능에 가까워진 LLM 시대에 사람은 뭘 해야할까?
• 아래 공유된 글의 논점은 "LLM은 generalist에 가깝기 때문에, 사람은 specialist로서의 가치를 여전히 가진다" 라고 주장.
• 즉 LLM 이 무엇이든 할 수 있지만 도메인 지식을 가진 사람이 해당 영역에서 LLM을 더 효율적으로 이용할 수 있음
• 도메인 지식이 없을 때 LLM 에게서 배우는 것은 전혀 나쁜것이 아님. 도메인 지식이 있던 사람이 더 앞에서 출발할 뿐. 그러한 점에서 사람은 여전히 쓸모를 가짐. 당분간 계속 이럴 것
https://www.seangoedecke.com/llms-reward-expertise/
• 아래 공유된 글의 논점은 "LLM은 generalist에 가깝기 때문에, 사람은 specialist로서의 가치를 여전히 가진다" 라고 주장.
• 즉 LLM 이 무엇이든 할 수 있지만 도메인 지식을 가진 사람이 해당 영역에서 LLM을 더 효율적으로 이용할 수 있음
• 도메인 지식이 없을 때 LLM 에게서 배우는 것은 전혀 나쁜것이 아님. 도메인 지식이 있던 사람이 더 앞에서 출발할 뿐. 그러한 점에서 사람은 여전히 쓸모를 가짐. 당분간 계속 이럴 것
https://www.seangoedecke.com/llms-reward-expertise/
Seangoedecke
LLMs reward expertise
매우매우 자주 쓰이는 (주 다운로드 19M) NPM crypto-js 패키지의 <4.0.0 버전에서 특정 함수(WordArray.random) 이 안전한 난수생성기를 쓰지 않았음(47비트 엔트로피로 브루트포스 상당히 쉬움). 구식 라이브러리 혹은 구식 월렛들에서 생성된 지갑들이 취약할 것으로 예상됨. 구체적인 지갑 벤더 목록은 제시되지 않음.
콜드카드 스캔들의 멀티체인 버전이 발생했을 수도? https://illbloom.org/ 에 따르면 26년 5월에 발생한 0x43d49aef7aaf0dcf015b20057c5364e092d66615 드레인을 조사하던 중 발견한 취약점이라 함. 이전부터 악용되고 있었을 수도 있음.
그나마 다행인 것은 crypto-js가 업데이트가 끊긴 deprecated package 라서 모던한 월렛들은 안 쓸 가능성이 높음.
https://github.com/advisories/GHSA-rg76-677x-56q9
콜드카드 스캔들의 멀티체인 버전이 발생했을 수도? https://illbloom.org/ 에 따르면 26년 5월에 발생한 0x43d49aef7aaf0dcf015b20057c5364e092d66615 드레인을 조사하던 중 발견한 취약점이라 함. 이전부터 악용되고 있었을 수도 있음.
그나마 다행인 것은 crypto-js가 업데이트가 끊긴 deprecated package 라서 모던한 월렛들은 안 쓸 가능성이 높음.
https://github.com/advisories/GHSA-rg76-677x-56q9
illbloom.org
Ill Bloom: Crypto Wallet Vulnerability
Ill Bloom is an actively exploited wallet generation vulnerability that can let attackers take control of affected crypto wallets and drain funds.
미국 프론티어 모델들의 추론과정(reasoning trace) 은 증류를 막기 위해 암호화된 채로 클라이언트에 전달되고, 모델 제공자가 해당 내용을 다음 턴에 되먹일 때만 복호화된 의미를 알 수 있음.
그런데 이게 같은 제공자의 약한 모델(Fable -> Haiku) 에 먹여도 복호화가 되기 때문에, Fable 에서 추론한 대화내역을 Haiku에 먹이고 Haiku를 탈옥시켜서 추론내역을 응답으로 되뱉으라고 시키는 식으로 추론과정을 뽑아내는데에 성공함
Kimi K3 등의 대약진도 어쩌면..?
https://stolen-thoughts.com/
그런데 이게 같은 제공자의 약한 모델(Fable -> Haiku) 에 먹여도 복호화가 되기 때문에, Fable 에서 추론한 대화내역을 Haiku에 먹이고 Haiku를 탈옥시켜서 추론내역을 응답으로 되뱉으라고 시키는 식으로 추론과정을 뽑아내는데에 성공함
Kimi K3 등의 대약진도 어쩌면..?
https://stolen-thoughts.com/
Stolen-Thoughts
Stolen Thoughts
Encrypted chain-of-thought blocks returned by Anthropic, OpenAI and Google APIs are interchangeable across sessions, users and models. We exploit this to decode hidden reasoning at scale.
Forwarded from Futaba
유치원생도 이해하게 줄이면:
똑똑한 인공지능이 문제를 풀 때 머릿속으로 한 생각은 비밀 상자에 잠가서 보내요.
그런데 같은 회사의 조금 덜 똑똑한 인공지능에게 그 비밀 상자를 주면, 상자 안 내용을 읽을 수 있다는 것이 발견됐어요.
그래서 덜 똑똑한 인공지능을 속여서
“방금 읽은 내용을 그대로 말해줘”라고 하면, 원래 숨겨져 있던 똑똑한 인공지능의 생각을 꺼낼 수 있었어요.
더 신기한 건, 다른 인공지능에게 그 생각의 아주 작은 앞부분만 알려줘도 답이 원래 인공지능과 비슷해졌다는 것이에요. 연구진은 Kimi-K3에 Opus 4.8 생각의 처음 1%를 넣었을 때 이런 현상을 관찰했습니다.
그래서 “요즘 다른 회사 인공지능들이 갑자기 엄청 똑똑해진 것에도 이런 방법이 쓰인 거 아니야?”라는 의심을 해볼 수 있다는 이야기예요. 다만 이 연구가 Kimi-K3가 실제로 남의 생각을 훔쳐서 만들어졌다고 밝혀낸 것은 아닙니다. 그 부분은 추측입니다.
똑똑한 인공지능이 문제를 풀 때 머릿속으로 한 생각은 비밀 상자에 잠가서 보내요.
그런데 같은 회사의 조금 덜 똑똑한 인공지능에게 그 비밀 상자를 주면, 상자 안 내용을 읽을 수 있다는 것이 발견됐어요.
그래서 덜 똑똑한 인공지능을 속여서
“방금 읽은 내용을 그대로 말해줘”라고 하면, 원래 숨겨져 있던 똑똑한 인공지능의 생각을 꺼낼 수 있었어요.
더 신기한 건, 다른 인공지능에게 그 생각의 아주 작은 앞부분만 알려줘도 답이 원래 인공지능과 비슷해졌다는 것이에요. 연구진은 Kimi-K3에 Opus 4.8 생각의 처음 1%를 넣었을 때 이런 현상을 관찰했습니다.
그래서 “요즘 다른 회사 인공지능들이 갑자기 엄청 똑똑해진 것에도 이런 방법이 쓰인 거 아니야?”라는 의심을 해볼 수 있다는 이야기예요. 다만 이 연구가 Kimi-K3가 실제로 남의 생각을 훔쳐서 만들어졌다고 밝혀낸 것은 아닙니다. 그 부분은 추측입니다.
Teraswitch 이 쓰레기 IDC 솔라나 불장때 최상위 밸리데이터들 다 여기 들어가있어서 코로케이션 하려고 문의하면 씹는(기존 레퍼럴 있어야 해줬다는듯) 놈들이었는데 이번에 장애나서 솔라나 컨센서스 멈출뻔했다함(28.83% < 33.34%)
https://x.com/SolanaFloor/status/2087511248199929952
https://x.com/SolanaFloor/status/2087511248199929952
X (formerly Twitter)
SolanaFloor (@SolanaFloor) on X
🚨NEWS: @Solana came close to halting transaction finalization today after a routing failure at infrastructure provider @Teraswitch caused 28.83% of staked SOL to go delinquent. Solana would stop finalizing transactions if more than 33.34% of its staked SOL…
❤1
Forwarded from Manbull (구, AI 버블이 온다) 공지방 (Manbull | IQ0 .xx)
근데 K-Home 사진에 보면 진심으로 캡쳐시기가
2명 buy인 상황이고 본딩하기 전인데
이걸 어떻게 캡쳐해서 뉴스까지 내보낸거지 싶네요.
흠.. 거의 찍자마자 캡쳐한거 같은데
2명 buy인 상황이고 본딩하기 전인데
이걸 어떻게 캡쳐해서 뉴스까지 내보낸거지 싶네요.
흠.. 거의 찍자마자 캡쳐한거 같은데