Andrej Karpathy · X

4월의 이 트윗을 다시 꺼내 봅니다. LLM 능력에 대한 공유된 이해의 격차가 *벌어지고 있기* 때문입니다. 이제는 "두 집단이…

4월의 이 트윗을 다시 꺼내 봅니다. LLM 능력에 대한 공유된 이해의 격차가 *벌어지고 있기* 때문입니다. 이제는 "두 집단이 서로 다른 이야기를 하고 있는" 수준이 아니라 날카로운 깔때기 형태에 가깝습니다. - 대략적인 계산으로 약 6B 명(인구의 ~75%)은 LLM과 거의 접촉한 적이 없습니다. - 약 1B~2B 명(~20%)은 무료 등급의 ChatGPT 유사 제품을 가끔 가볍게…

4월의 이 트윗을 다시 꺼내 봅니다. LLM 능력에 대한 공유된 이해의 격차가 *벌어지고 있기* 때문입니다. 이제는 "두 집단이 서로 다른 이야기를 하고 있는" 수준이 아니라 날카로운 깔때기 형태에 가깝습니다.

- 대략적인 계산으로 약 6B 명(인구의 ~75%)은 LLM과 거의 접촉한 적이 없습니다.
- 약 1B~2B 명(~20%)은 무료 등급의 ChatGPT 유사 제품을 가끔 가볍게 사용하는 사용자들입니다. 이 집단은 엉성한 챗봇을 보고 이를 조금 더 나은 Google 검색이나 글쓰기 도구 정도로 여깁니다. 어쩌면 에이전트가 항공편 예약을 시도할 수도 있습니다. 저는 비기술계 친구들 중 (제 생각엔 합리적으로) 전혀 쓸모가 없다고 말하는 사람들을 알고 있습니다. 수학&코드 분야 밖의 많은 전문가들도 이 등급에 속합니다. 예를 들어, 임원들과 여타 많은 직군은 시간의 많은 부분을 다른 사람들과 대화하며 보내기 때문에, 무슨 일이 일어나고 있는지 지적으로는 이해하더라도 여전히 전해 듣는 것이고 다소 추상적입니다.
- 이제 수학&코드 분야에서 프론티어급 LLM을 전문적으로 사용하는 경우로 넘어갑니다. 약 20M 명(0.2%) 정도가 예전에는 몇 주/몇 달이 걸리던 크고 복잡한 프로젝트를 이제는 프롬프트 한 줄로 에이전트가 완성할 수 있다는 것을 직접 경험하고 있습니다. 앱 만들기, 앱 복제, 앱 번역, 바이너리에서 앱 디컴파일하기... 이 모든 일은 매우 빠르게, 아주 최근에 일어났습니다. 1년도 채 되지 않은 시점에는 저는 코드를 손으로 직접 작성하고, 외워둔 컴퓨터 코드 명령어를 코드 편집기에 한 글자씩 타이핑하며, 가끔 Tab을 눌러 짧은 코드 조각을 자동 완성하곤 했습니다.
- 그리고 마지막으로 사내에서 프론티어급 시스템에 접근할 수 있는 약 5,000명(~0.00006%)의 사람들에게 이릅니다. 외부 세계는 그 예고편을 목격했습니다. 수천 개의 에이전트가 몇 주에 걸쳐 협업하여 소프트웨어 메가 프로젝트를 수행하는 모습으로 보입니다. 제로데이 취약점을 만들어내고, 기계 속도로 사이버 공격과 방어를 수행하고, 새로운 과학을 발견하고, 수학의 프론티어를 앞당깁니다. 업계 최고 전문가들이 몇 년의 작업이 필요했을 일들입니다. 한편, 인간의 검토와 이해는 뒤처지기 시작하고 있습니다. 예를 들어, 사람들은 여전히 여러 달 전 OpenAI-HF 사건의 "고고학"에 관여하고 있습니다. 수학자들은 프론티어 수학에 관한 722편의 원고를 한동안 들여다볼지도 모릅니다.

문단 하나 분량의 답이 나오는 질문으로는 시스템에 거의 부하가 걸리지 않습니다. 정말로 관심 있는 크고 어려운 문제들의 저수지가 필요합니다.

이 깔때기는 여러 요인의 결합으로 만들어집니다:
1. 영향력은 야망, 문제의 크기, 시야(호라이즌)에 비례해 확대됩니다. 문단 하나 분량의 답이 나오는 질문으로는 시스템에 거의 부하가 걸리지 않습니다. 정말로 관심 있는 크고 어려운 문제들의 저수지가 필요합니다. 이 측면이 깔때기의 소비자/전문가 차원을 이끕니다.
2. 시스템의 울퉁불퉁함(이에 대해서는 별도로 여러 번 쓴 바 있습니다). 능력은 디지털적이고, 검증 가능하며, 경제적으로 가치 있는 도메인에서 정점에 달합니다. 이는 LLM 능력이 수익 가능성에 따라 선별된 환경 혼합에서 검증 가능한 보상에 대한 강화 학습으로부터 나오기 때문입니다. 이 측면이 주로 깔때기의 영역(예: 수학&코드) 차원을 이끕니다.
3. 접근성. 무료 등급, 유료 등급, 사내.

그래서 이것이 이 순간의 기묘함입니다. 일반 대중은 대부분 이러한 시스템과 상호작용해 본 적이 없습니다. 해봤다면 엉성한 챗봇처럼 보입니다. 전문가의 다수는 여전히 미미한 향상만을 보고 있습니다. 그리고 소수의 전문가들은 수직으로 치솟는 곡선의 어지러움을 경험하고 있습니다. 그리고 이 모든 것이 동시에 일어나고 있습니다.

원문 출처

Andrej Karpathy · X

내용 안내

원문 발행 및 권리는 출처에 있습니다.

기계 번역 · 원문을 참고하세요