• Z.ai 의 최신 프론티어 모델 GLM-5.2 공개 및 가중치도 Day1 업로드
• Artificial Analysis 의 종합 지능 인덱스에서는 Opus 4.8 > GPT-5.5 > GLM-5.2 > Sonnet 4.6 정도의 순서로 정리 (모두 max 레벨)
• WeirdML에서는 GLM-5.2 high가 Opus 4.5 high를 이김
• 기존 중국 프론티어 모델들은 코딩이나 어시스턴트 에이전트(claw) 에 집중하는 분위기가 있었다고 보는데(특히 DeepSeek) WeirdML 결과 보면 이제 코딩만 잘하는 너드가 아니라 그냥 일머리 좋은 AI도 만들어낸것으로 이해됨. 생각해볼 점이 많은 부분
• 중국의 공개모델들과 미국 프론티어 모델은 6개월 가량의 격차가 유지되고 있는 것으로 보임. Fable 이 현재 Opus 처음 나올 때처럼 충격을 많이 줬는데 이것도 6개월 내로 따라잡을지가 관건
• 지금은 이들 중국회사들이 가중치를 선선히 다 열어주고 있는데, 6개월 뒤에도 계속 퍼줄지는 개인적으로 의문이긴 함. 이거 만드는데 드는 돈이 얼만데?
참고
• AA 인덱스: 여러 벤치마크 결과들을 적당히 가중치해서 하나의 점수로 줄세운 인덱스
• WeirdML: 에이전트에 다양, 잡다한 일들을 시켜보는 테마의 벤치마크(예시: 체스판 보고 경기 결과 예측). 넓은 범위에서의 문제해결능력을 평가
링크
• https://z.ai/blog/glm-5.2
• https://artificialanalysis.ai/#intelligence
• https://x.com/htihle/status/2067575504085926232
• Artificial Analysis 의 종합 지능 인덱스에서는 Opus 4.8 > GPT-5.5 > GLM-5.2 > Sonnet 4.6 정도의 순서로 정리 (모두 max 레벨)
• WeirdML에서는 GLM-5.2 high가 Opus 4.5 high를 이김
• 기존 중국 프론티어 모델들은 코딩이나 어시스턴트 에이전트(claw) 에 집중하는 분위기가 있었다고 보는데(특히 DeepSeek) WeirdML 결과 보면 이제 코딩만 잘하는 너드가 아니라 그냥 일머리 좋은 AI도 만들어낸것으로 이해됨. 생각해볼 점이 많은 부분
• 중국의 공개모델들과 미국 프론티어 모델은 6개월 가량의 격차가 유지되고 있는 것으로 보임. Fable 이 현재 Opus 처음 나올 때처럼 충격을 많이 줬는데 이것도 6개월 내로 따라잡을지가 관건
• 지금은 이들 중국회사들이 가중치를 선선히 다 열어주고 있는데, 6개월 뒤에도 계속 퍼줄지는 개인적으로 의문이긴 함. 이거 만드는데 드는 돈이 얼만데?
참고
• AA 인덱스: 여러 벤치마크 결과들을 적당히 가중치해서 하나의 점수로 줄세운 인덱스
• WeirdML: 에이전트에 다양, 잡다한 일들을 시켜보는 테마의 벤치마크(예시: 체스판 보고 경기 결과 예측). 넓은 범위에서의 문제해결능력을 평가
링크
• https://z.ai/blog/glm-5.2
• https://artificialanalysis.ai/#intelligence
• https://x.com/htihle/status/2067575504085926232
👍1
Cerebras 가 OpenRouter 에서 GPT-5.5 를 소량 서빙하는 것이 포착 (테스트 혹은 오류)
GPT-5.3 Codex Spark 등을 1000 TPS 로 서빙했었는데 Full GPT-5.5 를 200tps 로만 서빙해도 상당히 놀라울듯. 이거도 너프된 Spark 버전이면 유감 (GPT-5.3 Codex Spark 는 gpt-oss 에 GPT-5.3 을 증류한거라 많이 멍청했음. oss용 칩을 재활용하는거라)
https://www.reddit.com/r/singularity/comments/1u8lmmt/gpt_55_on_cerebras_appeared_today_secretly_in/
GPT-5.3 Codex Spark 등을 1000 TPS 로 서빙했었는데 Full GPT-5.5 를 200tps 로만 서빙해도 상당히 놀라울듯. 이거도 너프된 Spark 버전이면 유감 (GPT-5.3 Codex Spark 는 gpt-oss 에 GPT-5.3 을 증류한거라 많이 멍청했음. oss용 칩을 재활용하는거라)
https://www.reddit.com/r/singularity/comments/1u8lmmt/gpt_55_on_cerebras_appeared_today_secretly_in/
Mutt Technologies
Cerebras 가 OpenRouter 에서 GPT-5.5 를 소량 서빙하는 것이 포착 (테스트 혹은 오류) GPT-5.3 Codex Spark 등을 1000 TPS 로 서빙했었는데 Full GPT-5.5 를 200tps 로만 서빙해도 상당히 놀라울듯. 이거도 너프된 Spark 버전이면 유감 (GPT-5.3 Codex Spark 는 gpt-oss 에 GPT-5.3 을 증류한거라 많이 멍청했음. oss용 칩을 재활용하는거라) https://www.red…
GLM-5.2가 보안, 코딩과 같이 사고력 필요한 일부 작업에서 GPT-5.5 에 버금간다는 간증 나오고 있음
중국-미국 격차가 6개월에서 3개월 이하로 줄었을 수도...
https://x.com/banteg/status/2067630638979584333
중국-미국 격차가 6개월에서 3개월 이하로 줄었을 수도...
https://x.com/banteg/status/2067630638979584333
X (formerly Twitter)
banteg (@banteg) on X
not a bad result from glm-5.2, it found this after gpt-5.5 xhigh
Ada 대량 해킹사고의 원인은 EdDSA 논스를 랜덤하게 생성사지 않아 몇 개의 서명만 보고 키 복구가 가능했던 것으로 판명
공부할때 실험환경에서만 발생하던건데 이게 실제로 발생을 하는구나
참고로 자주 쓰이는 ed25519의 경우 생성된 논스에 3-4 비트만 편향이 있어도 비밀키 유출이 가능합니다
https://x.com/tayvano_/status/2070107628639047744
공부할때 실험환경에서만 발생하던건데 이게 실제로 발생을 하는구나
참고로 자주 쓰이는 ed25519의 경우 생성된 논스에 3-4 비트만 편향이 있어도 비밀키 유출이 가능합니다
https://x.com/tayvano_/status/2070107628639047744
X (formerly Twitter)
Tay 💖 (@tayvano_) on X
They did it. They actually did it.
They actually managed to fuck up and reuse nonces for Ed25519 sigs.
Incredible things happening on Cardano.
Innovation, even. 😳
They actually managed to fuck up and reuse nonces for Ed25519 sigs.
Incredible things happening on Cardano.
Innovation, even. 😳
Mutt Technologies
Cerebras 가 OpenRouter 에서 GPT-5.5 를 소량 서빙하는 것이 포착 (테스트 혹은 오류) GPT-5.3 Codex Spark 등을 1000 TPS 로 서빙했었는데 Full GPT-5.5 를 200tps 로만 서빙해도 상당히 놀라울듯. 이거도 너프된 Spark 버전이면 유감 (GPT-5.3 Codex Spark 는 gpt-oss 에 GPT-5.3 을 증류한거라 많이 멍청했음. oss용 칩을 재활용하는거라) https://www.red…
이거 컨펌됐는데(GPT-5.6 서빙) 그사이 주가는 30퍼넘게 박고 15퍼 반등
😇
https://x.com/aleabitoreddit/status/2070754658868687086
😇
https://x.com/aleabitoreddit/status/2070754658868687086
X (formerly Twitter)
Serenity (@aleabitoreddit) on X
Kinda nutty OpenAI’s is launching its heavyweight 5.6 Sol frontier model on $CBRS.
At up to 750 tokens/sec, which is obscene performance.
American inference go brrr.
I actually picked up starter positions on Cerebras for the first time in the ~170s (below…
At up to 750 tokens/sec, which is obscene performance.
American inference go brrr.
I actually picked up starter positions on Cerebras for the first time in the ~170s (below…
Fable 토큰값이 너무 비싸서 부담스러우시죠? 프롬포트를 이미지로 출력해서 Fable에 말아드셔보세요. Fable이 OCR해서 똑같은 효과를 누리면서 80% 할인 효과가 있다고 함
실용성이 있는지는 모르겠는데(사실 그냥 비전토큰 가격 올려버리면 그만) 웃겨서 가져옴
https://github.com/teamchong/pxpipe
실용성이 있는지는 모르겠는데(사실 그냥 비전토큰 가격 올려버리면 그만) 웃겨서 가져옴
https://github.com/teamchong/pxpipe
GitHub
GitHub - teamchong/pxpipe: cut Claude Code token usage by rendering text context as images
cut Claude Code token usage by rendering text context as images - teamchong/pxpipe
Forwarded from 마인부우의 크립토볼 (minebuu)
폴리마켓의 행동주의 트레이더
https://x.com/CarOnPolymarket/status/2074578109307699546?s=20
- 호날두가 월드컵에서 울까요?에 대한 플레이
- 어제 포르투갈 vs 스페인 경기에서 포르투갈이 패한후 호날두가 울까에 대한 분쟁이 발생함
- 초기 판정 결과는 No. 호날두가 울먹였음에도 불구하고 눈물을 흘리지는 않았다는 것이였음
- 이에 따라 yes는 18%까지 급락하였고 분쟁이 발생함
- CarOnPolymarket 유저는 영상과 수천 장의 사진을 몇시간 동안 찾으며 눈물이 흘리는 사진을 찾음
- 결국 왼쪽 눈에서 눈물 하나를 찾아냈고 높은 해상도를 위해 스톡 사진 사이트에서 사진을 구매
- 분쟁에 증거자료를 제출하여 결국 YES를 얻어냄. 따라서 yes가 20 cents -> 100 cents (5x)
https://x.com/CarOnPolymarket/status/2074578109307699546?s=20
- 호날두가 월드컵에서 울까요?에 대한 플레이
- 어제 포르투갈 vs 스페인 경기에서 포르투갈이 패한후 호날두가 울까에 대한 분쟁이 발생함
- 초기 판정 결과는 No. 호날두가 울먹였음에도 불구하고 눈물을 흘리지는 않았다는 것이였음
- 이에 따라 yes는 18%까지 급락하였고 분쟁이 발생함
- CarOnPolymarket 유저는 영상과 수천 장의 사진을 몇시간 동안 찾으며 눈물이 흘리는 사진을 찾음
- 결국 왼쪽 눈에서 눈물 하나를 찾아냈고 높은 해상도를 위해 스톡 사진 사이트에서 사진을 구매
- 분쟁에 증거자료를 제출하여 결국 YES를 얻어냄. 따라서 yes가 20 cents -> 100 cents (5x)
초대형 솔라나 밸리데이터 Helius와 Kiln이 특정 MEV봇의 트랜잭션을 우선해서 넣어주는 것이 관찰됨(트랜잭션 수수료를 안내는데도!). 뒤에서 딜을 했을것으로 추정
https://x.com/eightbitsim/status/2074490803234406832
"현행범 검거(caught red handed)" 라고 표현하는게 재미있는 부분
https://x.com/eightbitsim/status/2074490803234406832
"현행범 검거(caught red handed)" 라고 표현하는게 재미있는 부분
X (formerly Twitter)
8bit0 🏴☠️ (@eightbitsim) on X
Two @solana validator operators are caught red handed running private inclusion lanes for one of the biggest MEV bots on chain.
The backrunner MRiYA4oN3158fCV8evhuCofrDzbHyYvYnGZUDJvoCsa
for the backruns analyzed:
- Pays zero priority fee → 84% success…
The backrunner MRiYA4oN3158fCV8evhuCofrDzbHyYvYnGZUDJvoCsa
for the backruns analyzed:
- Pays zero priority fee → 84% success…
구글검색하다 찾은 쇼츠채널인데 한국어 솔라나 SIMD 설명을 AI생성해서 올리나보네요
대체 왜...? 재단에서 돈이라도 주나
https://www.youtube.com/@solana_1xp/shorts
대체 왜...? 재단에서 돈이라도 주나
https://www.youtube.com/@solana_1xp/shorts
YouTube
1분솔라나
Share your videos with friends, family, and the world
👏2❤1
나름 쏠쏠하게 에드 먹여줬던 Cypher Card가 다른 프로젝트에 인수되면서 카드사업을 접는다 합니다. 올해 9월 6일 전에 모든 잔고 출금하셔야 합니다.
자세한 내용은 https://cypherhq.io/wind-down-support
(메일로도 통지가 왔음)
자세한 내용은 https://cypherhq.io/wind-down-support
(메일로도 통지가 왔음)
Cypher
Wind-Down Support | Cypher
Every wind-down question, answered. Timeline, withdrawals, refunds, rewards, your wallet, and what happens after Cypher's platform shuts down.
3T 파라미터 모델 Kimi K3 공개, 가중치는 7월 27까지 업로드 예정
중국 모델들이 벤치맥싱이 심하지만 Fable에 근접하거나 일부는 능가한다는 점에서 상당히 고무적
https://kimi.com/blog/kimi-k3
중국 모델들이 벤치맥싱이 심하지만 Fable에 근접하거나 일부는 능가한다는 점에서 상당히 고무적
https://kimi.com/blog/kimi-k3
Kimi
Kimi K3 Tech Blog: Open Frontier Intelligence
Kimi K3 is the world's first open 3T-class model — frontier performance across coding, knowledge work, and reasoning, with native multimodality and 1M context.
Mutt Technologies
3T 파라미터 모델 Kimi K3 공개, 가중치는 7월 27까지 업로드 예정 중국 모델들이 벤치맥싱이 심하지만 Fable에 근접하거나 일부는 능가한다는 점에서 상당히 고무적 https://kimi.com/blog/kimi-k3
가장 놀라운 점은 바로 가격인데 Sonnet 5와 API 가격이 거의 비슷함. Reasoning 효율이 안좋다면 같은작업에 토큰수를 더 많이 쓰니 실질적인 가격이 높아질수는 있지만 일단 Opus보다는 압도적으로 가성비 좋을 것 같고 GPT-5.6 Sol/Terra 와도 비교해봐야 할듯