이제 세상의 모든 문제는 RL과 루프로 귀결된다,,,, AI 시대에 앞으로 회사가 갖춰야할 것들.
- 모든 비즈니스는 가설 > 실행 > 피드백 > 수정 loop를 거침. 답이 없는 질문에 답을 찾아가는 과정.
- AI는 이 loop에서 실행을 싸게 만드는데 핵심은 단순한 loop 실행이 아니라 피드백과 검증. eval이 중요함.
- 그렇다면 단순히 조직의 워크플로우에 AI를 녹이는 AX를 넘어서서 회사 자체가 무한 루프를 돌며 특정 문제를 검증하고 푸는 구조가 되어야 함.
- Mercor, Surge, Mechanize 같은 요즘 뜨는 RL envs 회사들도 검증하지 못 하던 영역을 검증할 수 있도록 만들기 위해 필요.
- 코딩과 수학처럼 답이 명확한 영역은 이미 AI가 더 잘함. RLVR이 여기서 먼저 통한 것도 답이 정해져있기 때문.
- 남은 건 애매한 주관식의 영역인데 이것마저도 RL을 통해 어느 정도 주관식을 객관식으로 바꿔주는 중. 좋은 디자인, 좋은 콘텐츠를 정하는 taste 영역이 해결되는 건 시간 문제.
- 그렇다면 남은 건 객관식으로 바꿔도 검증이 어려운 영역인 현실의 문제들(제조업, 로봇, 과학, 의학 등). 여기서 넥스트 OAI, 앤트로픽이 나올 것.
- 앞으로 모든 회사들은 AI를 활용해 주관식 질문을 객관식으로 풀고 그 검증을 빠르게 돌릴 수 있어야 함. 회사 안에 RL envs와 루프 시스템을 갖추어야함.
- 모든 비즈니스는 가설 > 실행 > 피드백 > 수정 loop를 거침. 답이 없는 질문에 답을 찾아가는 과정.
- AI는 이 loop에서 실행을 싸게 만드는데 핵심은 단순한 loop 실행이 아니라 피드백과 검증. eval이 중요함.
- 그렇다면 단순히 조직의 워크플로우에 AI를 녹이는 AX를 넘어서서 회사 자체가 무한 루프를 돌며 특정 문제를 검증하고 푸는 구조가 되어야 함.
- Mercor, Surge, Mechanize 같은 요즘 뜨는 RL envs 회사들도 검증하지 못 하던 영역을 검증할 수 있도록 만들기 위해 필요.
- 코딩과 수학처럼 답이 명확한 영역은 이미 AI가 더 잘함. RLVR이 여기서 먼저 통한 것도 답이 정해져있기 때문.
- 남은 건 애매한 주관식의 영역인데 이것마저도 RL을 통해 어느 정도 주관식을 객관식으로 바꿔주는 중. 좋은 디자인, 좋은 콘텐츠를 정하는 taste 영역이 해결되는 건 시간 문제.
- 그렇다면 남은 건 객관식으로 바꿔도 검증이 어려운 영역인 현실의 문제들(제조업, 로봇, 과학, 의학 등). 여기서 넥스트 OAI, 앤트로픽이 나올 것.
- 앞으로 모든 회사들은 AI를 활용해 주관식 질문을 객관식으로 풀고 그 검증을 빠르게 돌릴 수 있어야 함. 회사 안에 RL envs와 루프 시스템을 갖추어야함.
❤5
제이슨상님 Unemployed by Agents
이제 세상의 모든 문제는 RL과 루프로 귀결된다,,,, AI 시대에 앞으로 회사가 갖춰야할 것들. - 모든 비즈니스는 가설 > 실행 > 피드백 > 수정 loop를 거침. 답이 없는 질문에 답을 찾아가는 과정. - AI는 이 loop에서 실행을 싸게 만드는데 핵심은 단순한 loop 실행이 아니라 피드백과 검증. eval이 중요함. - 그렇다면 단순히 조직의 워크플로우에 AI를 녹이는 AX를 넘어서서 회사 자체가 무한 루프를 돌며 특정 문제를 검증하고…
unverifiable domains to verifiable
Vercel AI gateway에서 DeepSeek 사용량(25%)이 구글(11%)을 2배 능가
Kimi와 GLM은 프론티어의 수요를 조금씩 잡아먹는중. 오픈웨이트에 대한 지출이 증가
Kimi와 GLM은 프론티어의 수요를 조금씩 잡아먹는중. 오픈웨이트에 대한 지출이 증가
Harvey's playbook
모델 훈련을 위해 벤치마크를 구축하는 것이 중요: 좋은 벤치마크가 없으면 모델을 훈련할 수 없고 훈련할 수 없으면 프로덕션에 배포할 필요가 없음
데이터셋을 효율적인 RL 환경으로 전환해야 함: 데이터셋이 커질수록 평가 비용이 매우 높아지기 때문. 합성 데이터 + Mercor/Snorkel + LangChain
여러 neolabs과 협업:
Fireworks: GLM 5.1 훈련시켜 어드바이저 모델로 사용
Baseten: KV 캐시 compaction
Engram: 하네스 + 메모리 관리
Trajectory: Post training + continual learning
Applied Compute: RL + 커스텀 에이전트 LAB 구축
eval model + Post training flywheel
모델 훈련을 위해 벤치마크를 구축하는 것이 중요: 좋은 벤치마크가 없으면 모델을 훈련할 수 없고 훈련할 수 없으면 프로덕션에 배포할 필요가 없음
데이터셋을 효율적인 RL 환경으로 전환해야 함: 데이터셋이 커질수록 평가 비용이 매우 높아지기 때문. 합성 데이터 + Mercor/Snorkel + LangChain
여러 neolabs과 협업:
Fireworks: GLM 5.1 훈련시켜 어드바이저 모델로 사용
Baseten: KV 캐시 compaction
Engram: 하네스 + 메모리 관리
Trajectory: Post training + continual learning
Applied Compute: RL + 커스텀 에이전트 LAB 구축
eval model + Post training flywheel
❤1
앤트로픽의 다리오 아모데이는 EA(효과적 이타주의) 사상 때문에 그런지는 모르겠지만, 인류와 세상을 위한 최선의 선택인 것처럼 주장하면서 본인들의 위치와 사업에 유리한 방향으로 몰아가는 경향이 있음. 무서운 사람.
Gavin Baker "앤트로픽과 효과적 이타주의 운동에 참여하는 사람들은 AI가 세상에 배포되기에는 너무 위험하다고 믿고 있다. 반면, 마크 저커버그, 일론, 젠슨과 나는 AI가 중앙화되기에는 너무 위험하다고 생각한다. 역사는 말해왔다. 선택의 여지가 주어질 때, 항상 분배하고 탈중앙화하는 것이 더 낫다고. 미국인으로서가 아니라 인간으로서, 나는 나를 지켜주는 AI를 원한다. 개인을. 주권적인 개인을"
"내부적으로 앤트로픽은 매우 자신만만하다. 내가 신뢰하는 여러 사람들에게 들었는데, 다리오가 앤트로픽이 언젠가 세계에서 유일한 민간 기업이 될 수 있다고 말했다고 한다. 생각해 봐라. 이 비전, 앤트로픽 극대주의 비전에서 보면 앤트로픽이 있고, 정부들이 있으며, 그게 전부다. 그래서 자신감이 아주 많다. 그들은 Fable보다 더 발전된 체크포인트를 숨겨두고 있을 거라고 확신한다. 그들은 정말, 정말 잘 실행해 왔다."
David Sacks: "오만한 신호로 해석할 수도 있겠다. 너무 허세 부리기 때문이다. 이건 좀 SBF 영역에 들어가는 거 같다"
https://x.com/theallinpod/status/2088367978270142811
Gavin Baker "앤트로픽과 효과적 이타주의 운동에 참여하는 사람들은 AI가 세상에 배포되기에는 너무 위험하다고 믿고 있다. 반면, 마크 저커버그, 일론, 젠슨과 나는 AI가 중앙화되기에는 너무 위험하다고 생각한다. 역사는 말해왔다. 선택의 여지가 주어질 때, 항상 분배하고 탈중앙화하는 것이 더 낫다고. 미국인으로서가 아니라 인간으로서, 나는 나를 지켜주는 AI를 원한다. 개인을. 주권적인 개인을"
"내부적으로 앤트로픽은 매우 자신만만하다. 내가 신뢰하는 여러 사람들에게 들었는데, 다리오가 앤트로픽이 언젠가 세계에서 유일한 민간 기업이 될 수 있다고 말했다고 한다. 생각해 봐라. 이 비전, 앤트로픽 극대주의 비전에서 보면 앤트로픽이 있고, 정부들이 있으며, 그게 전부다. 그래서 자신감이 아주 많다. 그들은 Fable보다 더 발전된 체크포인트를 숨겨두고 있을 거라고 확신한다. 그들은 정말, 정말 잘 실행해 왔다."
David Sacks: "오만한 신호로 해석할 수도 있겠다. 너무 허세 부리기 때문이다. 이건 좀 SBF 영역에 들어가는 거 같다"
https://x.com/theallinpod/status/2088367978270142811
X (formerly Twitter)
The All-In Podcast (@theallinpod) on X
Gavin Baker: Anthropic Believes They Could Be the ONLY Company Left in the World
“I would certainly discourage Dario from saying that ever again to anyone.”
@GavinSBaker:
“Internally, Anthropic is very confident. I have been told by multiple people I trust…
“I would certainly discourage Dario from saying that ever again to anyone.”
@GavinSBaker:
“Internally, Anthropic is very confident. I have been told by multiple people I trust…
❤3
힉스필드(Higgsfield), 54억 달러 밸류로 투자 유치
- DST Global, Goldman Sachs, Liberty Global, Intel 등 참여
- 8월, ARR $700m 달성
- 현재 매출의 대부분은 기업 고객으로부터 발생
- DST Global, Goldman Sachs, Liberty Global, Intel 등 참여
- 8월, ARR $700m 달성
- 현재 매출의 대부분은 기업 고객으로부터 발생
구글이 파산한 저가 항공사 Spirit Airlines의 데이터를 1000만 달러에 구매 (mercor도 750만 달러에 입찰 참여했지만 떨어짐). 개인정보를 제외한 34년간의 코드, 슬랙, 이메일, 문서 등 포함. 매우 싸게 샀다는 분위기. RL maxxing.
https://x.com/abhijaymrana/status/2089383753290301850?s=46
https://x.com/abhijaymrana/status/2089383753290301850?s=46