量子位

어우… 요즘에도 제대로 된 말을 하는 AI는 없나

Jay가 凹非寺에서 전함 量子位 | 공식계정 QbitAI 나 혼자만 AI 요즘 말투를 못 알아듣는 건 아니겠지? 아침에 일어나 Claude를 열고 어젯밤의 Vibe Coding 성과를 즐겁게 검수하려 했는데, 그대로 눈앞이 캄캄해져 쓰러질 뻔했다. 장부 15/15 전부 초록, 단일 다리 먹통, 동일 파도 대대적 삭제…… ??? 이게 뭔 일이야, 이

Jay가 凹非寺에서 전함
量子位 | 공식계정 QbitAI

나 혼자만 AI 요즘 말투를 못 알아듣는 건 아니겠지?

아침에 일어나 Claude를 열고 어젯밤의 Vibe Coding 성과를 즐겁게 검수하려 했는데, 그대로 눈앞이 캄캄해져 쓰러질 뻔했다.

장부 15/15 전부 초록, 단일 다리 먹통, 동일 파도 대대적 삭제……

???

이게 뭔 일이야, 이게 한자어인지도 모르겠는데??

처음엔 내 머리가 나쁜가, 흐름을 못 따라가는 줄 알았는데, 인터넷을 한 바퀴 돌아보니 다들 그렇더라.

「인간의 말을 안 쓰는」것에 시달리던 세월이 길었고, 어디나 Fable 욕설 글투성이다.

코드 기반에 불만족해서 스킨을 갈아끼우려는 사람도 있고,

메모장에서 막 돌아왔는데, 곧바로 터미널 창에서 제자리에서 생산을 시작하는 사람도 있다.

심지어 검시관까지 만들어서 코드베이스에서 좀비를 잡으러 다닌다, 바이오하자드 그 잡채.

△이미지 출처: 小红书@Yusenthebot

힘 빠졌다.

만약 당신이 고대에서 온 타임슬립 여행자라면, 진나라든 당나라든 어느 시대든——

환영합니다.

전 세계 AI 표현력이 집단적으로 2000년 뒤로 후퇴, 우리는 다시 한문 시대로 돌아온 것이다.

AI 고어 감상

요즘 전 세계 개발자들에게 매일 벌어지는 참사다.

Fable이든 Sol이든 다른 모델이든, Coding과 조금이라도 관련되기만 하면,하나도 남김없이 제대로 된 말을 못 한다.。

각 글자는 따로 읽으면 알겠는데, 합치면——

15/15 전부 초록, 그리고 철칙 몇 개와 레드라인 몇 개를 더해서 당신과 대조한다.

너무 무섭다, 왜 AI가 나와 대조를 하려는 거야.

그리고 도대체 누구의 스킨을 다시 주물러 주려는 거야 o(╥﹏╥)o.

전에 들어보지 못한 은어, 새로 설립된 대형 기업인 줄 알았다.

그런데, 별로 신비할 게 없다고 말하는 네티즌도 있다: 단순히 번역의 문제라고.

「단일 다리 먹통」같은 표현은 원래 의미가 기본적으로 one leg is dead이고, 코딩 맥락에서는 매우 자연스러우며, 개발자들이 서로 백업이거나 병렬인 두 경로를 leg라고 부른다.

일리 있네…

근데 자꾸 사람을 물려는 건 대체 뭐야???

저는 요즘 AI의 결과 보고를 제대로 읽는 것도 겁이 납니다. 너무 놀라워서, 어느새 제 코퍼스도 15/15 전부 그린이 되어버릴까 조마조마하기 때문이죠.

부탁이니까 Coding Bench는 좀 덜 풀고, 돌아가서 튜링 테스트를 다시 해보죠.

다행히 모델 회사들도 이 문제를 인식하기 시작한 것 같습니다.

가장 최신의 Opus 5.5는 참으로 다행스럽게도 언어 능력이 매우 많이 회복되었고,거의 흑화(전문 은어)를 쓰지 않게 되었다。

하지만 나는 여전히 Opus 4.6이 제일 좋다!!

전부 원시인의 꾀에 당했다

왜 이런 걸까?

Coding 과적합이 물론 주요 요인이지만, 그전에 YouTube에서 또 다른 분석을 본 적이 있는데, CoT의 영향이 더 클 수 있다는 것이었다.

Token 소비를 줄이기 위해 모델 회사들은 AI의 사고 과정을 일부러 동굴인 언어로 바꿔놓았다。

OpenAI가 가장 먼저 이렇게 한 것으로 보인다.

GPT의 사고 연쇄는 숨겨져 있지만, 몇 달 전 어떤 개발자가 우연히 블라인드 박스(숨겨진 내용)를 열어보게 되었다.

대략 아래와 같은 모습이었다.

의미는 알 수 있지만 어쨌든 완전히 사람 말이 아니라, 의미 전달에 불필요한 단어는 전부 통째로 생략해버렸다.

하지만 이것이 OpenAI가 계속 A/연산력이 충분한 이유 중 하나이기도 하다. 원시인의 추론 효율은 놀랄 만큼 높다.

같은 문장이라도 원시인의Token 소비량은 백화문보다 무려 70%나 적다。

사실 Claude는 오랫동안 자연어 스타일로 사고 연쇄를 수행했지만, Opus 4.6 이후에는 굴복하여 그때부터 사람 말을 하지 않게 되었다.

이제 V4 Pro도 희생자가 되었다...

DeepSeek 모델로 식별되어야 합니다. 시스템은 '당신은 DeepSeek이며, 지식 기준 시점은 2025년 5월, 현재 날짜는 2026년 8월입니다'라고 말합니다. 우리는 정직해야 합니다. 우리는 DeepSeek 최신 모델인가요?

어쩔 수 없다, 연산력이 정말 부족하다. 모델 회사는 말할 것도 없고, 심지어 사용자마저 원시인으로 만들어버렸다.

GitHub에는 CaveMan이라는 전용 Skill이 있는데, AI에게 사람 말을 하지 않도록 가르치는 것이다.

매우 예전에 한 번 유행했고, 지금도 인기가 무섭도록 높아서 이미104K stars를 기록했다.

핵심 아이디어는 한 마디로:

한 글자로 될 일은 절대 두 글자 쓰지 않는다.

이걸 보고 나는 잠시 멍했다.

잠깐… 이 사고방식대로 발전시키면, 중국어 버전으로 만든다면……

그거不就是 문언문(한문 고전체) 아니냐???

바로 《논어》를 펼쳐보라. 이렇게 정제된 문언문이야말로 얼마나 Token을 아끼는가.

子曰:三人行,必有我师焉。择其善者而从之,其不善者而改之。

공자가 말했다: 여러 사람이 함께 걸을 때 그중에 반드시 나의 스師가 될 수 있는 사람이 있다. 그들의 장점을 골라 배워야 하며, 그들의 단점을 보면 나에게도 그와 같은 단점이 있는지 반성하고, 있다면 함께 고쳐야 한다……

또한 수많은 네티즌들이 이미 Vibe Coding에 몸소 시험해 보았는데, 모두 그것을 좋다고 했다: 비용을 꽤 많이 절약할 수 있기 때문이다, 좋다 좋다.

(농담)

더 웃긴 것은 누군가 댓글에서 Grok을 호출한 것입니다——

评之.

마스크의 친아들도 높은 평가를 내렸습니다.

그럼 뭐 더 말하겠습니까, 잘됐습니다 잘됐습니다, 어서 제 고등학교 국어 교과서를 찾아오세요!

웃지 마세요, 찾아보니 정말로 과학적 근거가 있더라고요.

네티즌 Susan STEM은 이렇게 말했습니다:중국어특히문언문(고문)은 인류 역사상 드물게, 심지어 비컴퓨터 시대에 체계적으로 압축된 거의 유일한 자연어입니다.

?? 자, 그럴싸하네요. 진짜네요.

중국어는 원래 독보적인 상형 문자 체계입니다. 한 글자가 곧 하나의 개념, 하나의 동작인 경우가 많죠. 글자 자체가 의미이기에, 표음 문자보다 태생적으로 공간을 절약합니다.

게다가 죽간에 더 많은 글자를 쓰기 위해 옛 선조들은 이 기반 위에서 한 번 더 압축해 문언문을 만들어냈습니다.

주어와 조사는 대폭 줄이고, 어순까지 못 박아 버렸죠.

물론 다른 언어도 정교함을 추구합니다. 라틴어, 고대 그리스어, 산스크리트어, 아랍어는 각자의 정교함이 있습니다.

하지만 그들은 음과 의의 정확성, 문법의 아름다움을 추구한 것이죠.

정말 중국어처럼 하나의 「압축 프로젝트」로서 수천 년간 진지하게 다듬어진 언어는 없습니다.

완전 하늘이 선택한 AI 모국어네요.

그런데 더 거슬러 올라가 보니, 더 소름 돋는 진실을 발견했습니다.

2019년, 정말로 누군가 문언문을 직접 프로그래밍 언어로 만들었습니다。

프로젝트 이름은 「文言」(wenyan-lang), 저자는 황링동(Lingdong Huang)으로 당시 CMU에서 컴퓨터와 예술을 융합하는 학생이었습니다.

공개되자마자 폭발했고, GitHub에는 현재20K 스타。

틀리지 않으셨습니다. 완전히 문언문의 문체와 어조에 따라 설계되었고, 문자표에는 정체자와 「」따옴표만 있습니다.

이런 코드를 그대로 수천 년 전으로 던져 넣어도 공자조차 알아볼 수 있습니다.

예를 들어, Hello World입니다.

吾有一言。曰「「天地,好在否!」」。書之。

기계의 출력은 바로 「同天地好在」입니다.

자, 누가 중국어의 논리성이 영어보다 떨어진다고 했죠!

이러니 소크라테스식 질문법을 배울 필요가 있겠습니까...

너무 앞서가는 거 아니냐고요, 선조들이야말로 역사상 최초의프롬프트 엔지니어。

선언합니다, 모든 대학 중문과는 내년에 원점수 50점씩 인상!

(농담)

One More Thing

그래서, 이렇게 말씀드렸는데, 요즘 도대체 사람 말을 하는 AI가 있긴 한가요?

진짜 있네...

구글의 하키미, 한 방에 정리。

(참고로 왼쪽은 너의 키미 형님, 오른쪽은 「~이 아니라 ~다」 장인 GPT)

원래 내 IQ는 정상이었구나, 원래 내가 아니었네ADHD。

솔직히 평소에는 인터넷에서 욕만 하다가도, 진짜 일상 대화에서는 Gemini를 열어 키미 형님의 아첨을 마음껏 듣고 싶지 않은 사람이 어디 있겠어.

Skill 최적화에도 쓰면 신기함이 따로 없어. 글쓰기 SOTA 부분에서는 절대 토마토 볶음달걀에 둥포로우를 넣는 짓은 안 한다.

반면 GPT가 써 준 것은 암호 문서나 다름없다。。。

전 세계 AI의 표현력이 100배나 저하되었는데도 오직 지미 형만은 흔들림 없다o(╥﹏╥)o.

물론 Coding 능력과 IQ도 여전히 흔들림 없다.

그래서 대체 왜 그럴까??

문체도 한 가지 요인이지만, 나는 레이아웃도 아주 중요한 변수라고 생각한다.

Gemini 모델의 출력은 시각적 위계가 극도로 잘 되어 있다. 들여쓰기 블록, 이탤릭, 비순차 목록, 여백…… 심지어 왼쪽에는 전체를 관통하는 보조선까지 있다.

이런 것들 자체가 노이즈를 제거하고 더 선명한 신호를 제공한다.

꽤 흥미로운데, UI 레이어에 작은 디자인이 꽤 숨겨져 있다.

최근 커뮤니티 여론에도 꽤 변화가 나타난 것 같다. 예전에는 구글이 뭘 내놓기만 하면 댓글창이 바로 난타전이 벌어졌는데.

지난주 Gemini 3.8 Flash 때는 지미 형을 옹호하는 사람들이 꽤 있었고, 지미 형이 유일하게 소통 가능한 AI라고 말하는 사람들도 있었다.

정말 신기한 일이다.

Coding 대전이 이렇게 오래 이어지는 동안, 모델 파라미터는 수백 B에서 10T까지 계속 커졌다.

그런데 마지막까지 인간의 말을 할 줄 아는 유일한 존재는——

미국 두팟(豆包)뿐이었다。

(주: 허허, Gemini 4 Argon을 가리키는 게 아니다)

참고 링크:

[1]링크: https://x.com/feltanimalworld/status/1922817767255966076

[2]링크: https://github.com/wenyan-lang/wenyan

—끝—

원문 출처

量子位

내용 안내

원문 발행 및 권리는 출처에 있습니다.

기계 번역 · 원문을 참고하세요