OpenAI 의 최신 모델들 GPT-5.6 업데이트
• Sol Fast 모드 추가
• Terra 20% 할인
• Luna 80% 할인 (?????)
이정도면 중국모델들 제발 쓰지말고 우리꺼 써줘 수준인데... Luna 가 GLM-5.2랑 비슷한 체급을 보여주는데 가격을 여기에 맞춘듯
https://x.com/OpenAI/status/2082878156483219672
• Sol Fast 모드 추가
• Terra 20% 할인
• Luna 80% 할인 (?????)
이정도면 중국모델들 제발 쓰지말고 우리꺼 써줘 수준인데... Luna 가 GLM-5.2랑 비슷한 체급을 보여주는데 가격을 여기에 맞춘듯
https://x.com/OpenAI/status/2082878156483219672
X (formerly Twitter)
OpenAI (@OpenAI) on X
We are committed to pushing the model frontier across cost efficiency, capability, and speed.
Starting today, we are reducing prices for GPT-5.6 Luna by 80% and GPT-5.6 Terra by 20% , and offering a faster option for GPT-5.6 Sol in the API.
Luna and Terra’s…
Starting today, we are reducing prices for GPT-5.6 Luna by 80% and GPT-5.6 Terra by 20% , and offering a faster option for GPT-5.6 Sol in the API.
Luna and Terra’s…
DeepSeek V4 Flash 를 사후학습 더 많이 한 0731 버전이 API로 출시. 벤치마크 상으로는 DS V4 Pro와 GLM-5.2를 발라버림(???)
실사용 후기가 나와봐야 알겠지만 뭔가 엄청난 일이 일어나고 있는듯...;;; GPT Luna 떨이가 이래서 나왔나
가중치는 아직 안올라온듯 올라옴. https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731
https://x.com/deepseek_ai/status/2083084415157022911
실사용 후기가 나와봐야 알겠지만 뭔가 엄청난 일이 일어나고 있는듯...;;; GPT Luna 떨이가 이래서 나왔나
https://x.com/deepseek_ai/status/2083084415157022911
X (formerly Twitter)
DeepSeek (@deepseek_ai) on X
🚀 DeepSeek-V4-Flash Official API is now LIVE in public beta!
🔷 We’ve massively upgraded its Agent capabilities—benchmark scores are now far surpassing the V4-Pro-Preview. Check out the massive performance leap below! 👇
🔷 The official V4-Flash now natively…
🔷 We’ve massively upgraded its Agent capabilities—benchmark scores are now far surpassing the V4-Pro-Preview. Check out the massive performance leap below! 👇
🔷 The official V4-Flash now natively…
하락장에 돈 잃으셔서 속쓰리시죠? 스레드의 최신 도파민 분출 이슈나 보고 가시죠
• K-Skill 이라고 한국 최적화(KTX 예매, 카카오톡 조작, ...) 에이전트 스킬목록을 만들어서 배포하던 개발자가 있음(Github Star >6K)
• 맛집 DB 블루리본 관련된 스킬도 포함. 근데 얘네는 알다시피 그걸로 먹고사는 사업자라 크롤러 차단했음
• 역공학하고 이런저런 방법으로 뚫어서 씀(개발자 명의로 결제해서 재배포까지 함) https://github.com/NomaDamas/k-skill/pull/94
• 블루리본이 바로 고소 https://www.threads.com/@bunniesossdev/post/DbaTxkPkXSO
• 정신 못차리고 블루리본의 오픈소스 대체 DB(??) 를 만들자고 함 https://www.threads.com/@bunniesossdev/post/DbaxbKmET_y
• 여러 가지 맛이 간 행적들 재발굴 중 https://x.com/chevrefabuleuse/status/2083075133355569461
• K-Skill 이라고 한국 최적화(KTX 예매, 카카오톡 조작, ...) 에이전트 스킬목록을 만들어서 배포하던 개발자가 있음(Github Star >6K)
• 맛집 DB 블루리본 관련된 스킬도 포함. 근데 얘네는 알다시피 그걸로 먹고사는 사업자라 크롤러 차단했음
• 역공학하고 이런저런 방법으로 뚫어서 씀(개발자 명의로 결제해서 재배포까지 함) https://github.com/NomaDamas/k-skill/pull/94
• 블루리본이 바로 고소 https://www.threads.com/@bunniesossdev/post/DbaTxkPkXSO
• 정신 못차리고 블루리본의 오픈소스 대체 DB(??) 를 만들자고 함 https://www.threads.com/@bunniesossdev/post/DbaxbKmET_y
• 여러 가지 맛이 간 행적들 재발굴 중 https://x.com/chevrefabuleuse/status/2083075133355569461
❤1
거의 사실상 보편지능에 가까워진 LLM 시대에 사람은 뭘 해야할까?
• 아래 공유된 글의 논점은 "LLM은 generalist에 가깝기 때문에, 사람은 specialist로서의 가치를 여전히 가진다" 라고 주장.
• 즉 LLM 이 무엇이든 할 수 있지만 도메인 지식을 가진 사람이 해당 영역에서 LLM을 더 효율적으로 이용할 수 있음
• 도메인 지식이 없을 때 LLM 에게서 배우는 것은 전혀 나쁜것이 아님. 도메인 지식이 있던 사람이 더 앞에서 출발할 뿐. 그러한 점에서 사람은 여전히 쓸모를 가짐. 당분간 계속 이럴 것
https://www.seangoedecke.com/llms-reward-expertise/
• 아래 공유된 글의 논점은 "LLM은 generalist에 가깝기 때문에, 사람은 specialist로서의 가치를 여전히 가진다" 라고 주장.
• 즉 LLM 이 무엇이든 할 수 있지만 도메인 지식을 가진 사람이 해당 영역에서 LLM을 더 효율적으로 이용할 수 있음
• 도메인 지식이 없을 때 LLM 에게서 배우는 것은 전혀 나쁜것이 아님. 도메인 지식이 있던 사람이 더 앞에서 출발할 뿐. 그러한 점에서 사람은 여전히 쓸모를 가짐. 당분간 계속 이럴 것
https://www.seangoedecke.com/llms-reward-expertise/
Seangoedecke
LLMs reward expertise
매우매우 자주 쓰이는 (주 다운로드 19M) NPM crypto-js 패키지의 <4.0.0 버전에서 특정 함수(WordArray.random) 이 안전한 난수생성기를 쓰지 않았음(47비트 엔트로피로 브루트포스 상당히 쉬움). 구식 라이브러리 혹은 구식 월렛들에서 생성된 지갑들이 취약할 것으로 예상됨. 구체적인 지갑 벤더 목록은 제시되지 않음.
콜드카드 스캔들의 멀티체인 버전이 발생했을 수도? https://illbloom.org/ 에 따르면 26년 5월에 발생한 0x43d49aef7aaf0dcf015b20057c5364e092d66615 드레인을 조사하던 중 발견한 취약점이라 함. 이전부터 악용되고 있었을 수도 있음.
그나마 다행인 것은 crypto-js가 업데이트가 끊긴 deprecated package 라서 모던한 월렛들은 안 쓸 가능성이 높음.
https://github.com/advisories/GHSA-rg76-677x-56q9
콜드카드 스캔들의 멀티체인 버전이 발생했을 수도? https://illbloom.org/ 에 따르면 26년 5월에 발생한 0x43d49aef7aaf0dcf015b20057c5364e092d66615 드레인을 조사하던 중 발견한 취약점이라 함. 이전부터 악용되고 있었을 수도 있음.
그나마 다행인 것은 crypto-js가 업데이트가 끊긴 deprecated package 라서 모던한 월렛들은 안 쓸 가능성이 높음.
https://github.com/advisories/GHSA-rg76-677x-56q9
illbloom.org
Ill Bloom: Crypto Wallet Vulnerability
Ill Bloom is an actively exploited wallet generation vulnerability that can let attackers take control of affected crypto wallets and drain funds.
미국 프론티어 모델들의 추론과정(reasoning trace) 은 증류를 막기 위해 암호화된 채로 클라이언트에 전달되고, 모델 제공자가 해당 내용을 다음 턴에 되먹일 때만 복호화된 의미를 알 수 있음.
그런데 이게 같은 제공자의 약한 모델(Fable -> Haiku) 에 먹여도 복호화가 되기 때문에, Fable 에서 추론한 대화내역을 Haiku에 먹이고 Haiku를 탈옥시켜서 추론내역을 응답으로 되뱉으라고 시키는 식으로 추론과정을 뽑아내는데에 성공함
Kimi K3 등의 대약진도 어쩌면..?
https://stolen-thoughts.com/
그런데 이게 같은 제공자의 약한 모델(Fable -> Haiku) 에 먹여도 복호화가 되기 때문에, Fable 에서 추론한 대화내역을 Haiku에 먹이고 Haiku를 탈옥시켜서 추론내역을 응답으로 되뱉으라고 시키는 식으로 추론과정을 뽑아내는데에 성공함
Kimi K3 등의 대약진도 어쩌면..?
https://stolen-thoughts.com/
Stolen-Thoughts
Stolen Thoughts
Encrypted chain-of-thought blocks returned by Anthropic, OpenAI and Google APIs are interchangeable across sessions, users and models. We exploit this to decode hidden reasoning at scale.
Forwarded from Futaba
유치원생도 이해하게 줄이면:
똑똑한 인공지능이 문제를 풀 때 머릿속으로 한 생각은 비밀 상자에 잠가서 보내요.
그런데 같은 회사의 조금 덜 똑똑한 인공지능에게 그 비밀 상자를 주면, 상자 안 내용을 읽을 수 있다는 것이 발견됐어요.
그래서 덜 똑똑한 인공지능을 속여서
“방금 읽은 내용을 그대로 말해줘”라고 하면, 원래 숨겨져 있던 똑똑한 인공지능의 생각을 꺼낼 수 있었어요.
더 신기한 건, 다른 인공지능에게 그 생각의 아주 작은 앞부분만 알려줘도 답이 원래 인공지능과 비슷해졌다는 것이에요. 연구진은 Kimi-K3에 Opus 4.8 생각의 처음 1%를 넣었을 때 이런 현상을 관찰했습니다.
그래서 “요즘 다른 회사 인공지능들이 갑자기 엄청 똑똑해진 것에도 이런 방법이 쓰인 거 아니야?”라는 의심을 해볼 수 있다는 이야기예요. 다만 이 연구가 Kimi-K3가 실제로 남의 생각을 훔쳐서 만들어졌다고 밝혀낸 것은 아닙니다. 그 부분은 추측입니다.
똑똑한 인공지능이 문제를 풀 때 머릿속으로 한 생각은 비밀 상자에 잠가서 보내요.
그런데 같은 회사의 조금 덜 똑똑한 인공지능에게 그 비밀 상자를 주면, 상자 안 내용을 읽을 수 있다는 것이 발견됐어요.
그래서 덜 똑똑한 인공지능을 속여서
“방금 읽은 내용을 그대로 말해줘”라고 하면, 원래 숨겨져 있던 똑똑한 인공지능의 생각을 꺼낼 수 있었어요.
더 신기한 건, 다른 인공지능에게 그 생각의 아주 작은 앞부분만 알려줘도 답이 원래 인공지능과 비슷해졌다는 것이에요. 연구진은 Kimi-K3에 Opus 4.8 생각의 처음 1%를 넣었을 때 이런 현상을 관찰했습니다.
그래서 “요즘 다른 회사 인공지능들이 갑자기 엄청 똑똑해진 것에도 이런 방법이 쓰인 거 아니야?”라는 의심을 해볼 수 있다는 이야기예요. 다만 이 연구가 Kimi-K3가 실제로 남의 생각을 훔쳐서 만들어졌다고 밝혀낸 것은 아닙니다. 그 부분은 추측입니다.
Teraswitch 이 쓰레기 IDC 솔라나 불장때 최상위 밸리데이터들 다 여기 들어가있어서 코로케이션 하려고 문의하면 씹는(기존 레퍼럴 있어야 해줬다는듯) 놈들이었는데 이번에 장애나서 솔라나 컨센서스 멈출뻔했다함(28.83% < 33.34%)
https://x.com/SolanaFloor/status/2087511248199929952
https://x.com/SolanaFloor/status/2087511248199929952
X (formerly Twitter)
SolanaFloor (@SolanaFloor) on X
🚨NEWS: @Solana came close to halting transaction finalization today after a routing failure at infrastructure provider @Teraswitch caused 28.83% of staked SOL to go delinquent. Solana would stop finalizing transactions if more than 33.34% of its staked SOL…
❤1
Forwarded from Manbull (구, AI 버블이 온다) 공지방 (Manbull | IQ0 .xx)
근데 K-Home 사진에 보면 진심으로 캡쳐시기가
2명 buy인 상황이고 본딩하기 전인데
이걸 어떻게 캡쳐해서 뉴스까지 내보낸거지 싶네요.
흠.. 거의 찍자마자 캡쳐한거 같은데
2명 buy인 상황이고 본딩하기 전인데
이걸 어떻게 캡쳐해서 뉴스까지 내보낸거지 싶네요.
흠.. 거의 찍자마자 캡쳐한거 같은데
GPT 5.6/Mythos 이후로 CTF 대회들도 토큰 많이쓰기 대회가 되어가서 보안업계에서 위기감을 상당히 느끼나 보네요. OtterSec 은 아예 CTF 살리기 기금 $100k 걸어두고 이런 문제를 해결하려는 시도를 하는 CTF 에 스폰서 해주겠다고 함
올해 데프콘 우승자도 LLM 전쟁이 된 현재 CTF 구조가 잘못되어간다고 보고 접으신 상황...(*사실 원래 슬슬 접으려 하셨다고 다른 글에서 설명하시긴 했음)
https://x.com/RBTree_/status/2087577069295391172
올해 데프콘 우승자도 LLM 전쟁이 된 현재 CTF 구조가 잘못되어간다고 보고 접으신 상황...(*사실 원래 슬슬 접으려 하셨다고 다른 글에서 설명하시긴 했음)
https://x.com/RBTree_/status/2087577069295391172
OtterSec
Announcing the Save CTFs Fund
OtterSec is committing $100,000 to keep CTFs competitive in the age of AI. We break down why Jeopardy scoring is breaking down, what better formats might look like, and how to apply for sponsorship.
😭1
Cerebras 칩은 자체 프로그래밍언어 CSL(Cerebras Software Language) 을 쓰는데 모델이 상당히 독특하네요.
칩 자체가 웨이퍼 1개의에 90만개의 연산기를 평면 격자로 깔아둔 구조인데, 실제로 프로그래밍 할때도 각 연산기를 독립적으로 컨트롤하고 각 연산기는 연산을 한 뒤에 상하좌우 4개의 연산기와만 소통하는 식. DRAM, HBM 없고 캐시도 없고 그냥 이게 끝이라 함 ㅋㅋ
이게 뭔가싶지만 이걸로 이번에 Sol Ultfafast 작업한게 최데 750tps라니까 일단은 잘 먹히는 듯(gpt-oss-120b는 3000tps도 찍힘).
웨이퍼를 통으로 쓰다보니 수율문제가 있는걸로 아는데 구조가 단순해서 적층 똥꼬쇼 하는 HBM 보다는 수율 올리기가 쉽나? 싶기도 하네요 (전자 아예 모름)
https://x.com/wafer_ai/status/2087964176123900005
칩 자체가 웨이퍼 1개의에 90만개의 연산기를 평면 격자로 깔아둔 구조인데, 실제로 프로그래밍 할때도 각 연산기를 독립적으로 컨트롤하고 각 연산기는 연산을 한 뒤에 상하좌우 4개의 연산기와만 소통하는 식. DRAM, HBM 없고 캐시도 없고 그냥 이게 끝이라 함 ㅋㅋ
이게 뭔가싶지만 이걸로 이번에 Sol Ultfafast 작업한게 최데 750tps라니까 일단은 잘 먹히는 듯(gpt-oss-120b는 3000tps도 찍힘).
웨이퍼를 통으로 쓰다보니 수율문제가 있는걸로 아는데 구조가 단순해서 적층 똥꼬쇼 하는 HBM 보다는 수율 올리기가 쉽나? 싶기도 하네요 (전자 아예 모름)
https://x.com/wafer_ai/status/2087964176123900005
X (formerly Twitter)
wafer (@wafer_ai) on X
🚨 GPT-5.6-Sol Ultrafast mode (750 TPS) is here powered by Cerebras!
Here's How kernels work on Cerebras Chips
cerebras built a chip with 900,000 cores on a single silicon wafer.
CSL (Cerebras Software Language) is a Zig-inspired DSL that gives you direct…
Here's How kernels work on Cerebras Chips
cerebras built a chip with 900,000 cores on a single silicon wafer.
CSL (Cerebras Software Language) is a Zig-inspired DSL that gives you direct…
Mutt Technologies
지캐시 업데이트 쉬운설명 1. 스위스 은행에 돈복사 버그 생김. 돈복사한 돈이 실제로 출금되어서 실제 잔고보다 출금액이 많으면 내돈은 못찾아갈수 있음(구 Orchard Pool) 2. 뒤늦게 돈복사버그를 알았지만 ZK증명의 특성상 언제 누가 돈복사를 했는지, 한번도 발생하지 않았는지는 알수가 없음 (당연한게 거래내역 숨기라고 만든거니) 3. 이번에 제시된 해결책은 돈복사 버그가 해결된 (신) 스위스 은행을 만든 뒤에, (구) 스위스 은행 사용자들이 알아서…
이거 지캐시 유통량의 94%까지는 확인되어서 이제 검증되지 않은 옛날 익명성 풀의 ZEC 개수는 1M 아래라 함 ($1M 이 아님에 유의)
https://x.com/cipherscan_app/status/2087902659684470979
https://x.com/cipherscan_app/status/2087902659684470979
X (formerly Twitter)
CipherScan (@cipherscan_app) on X
Under 1M ZEC left unverifiable.
When Orchard fully drains, Zcash supply becomes ~100% auditable. The data was right.
Private and auditable.
Only Zcash.
When Orchard fully drains, Zcash supply becomes ~100% auditable. The data was right.
Private and auditable.
Only Zcash.
Mutt Wastes His Life
워터밤 개봉이요
Opus 4.7 Max 를 집에서 돌릴수 있다고 하네요 대박 (*DeepSWE 벤치마크 기준)
서강대 재학생 및 졸업생 개인정보가 대규모로 유출되어서 난리인데... 52년생 70학번 박*혜 씨도 피해자 명단에 올라가 있네요 진짜 디비 싹 털어가긴 한듯
하 씨 누구지... 진짜 모르겠네
https://x.com/whysolonely1024/status/2088479159991541782
하 씨 누구지... 진짜 모르겠네
https://x.com/whysolonely1024/status/2088479159991541782
X (formerly Twitter)
친석당원 (@whysolonely1024) on X
1952년생 70학번 박X혜 씨 개인정보 유출되셨다네요 ㅠㅠ