아래로 당겨서 돌아가기
왜 AI는 간단한 ASCII 이미지도 못 만들까?

왜 AI는 간단한 ASCII 이미지도 못 만들까?

Why does AI fail to generate simple ASCII images?

MineBench에 대한 글을 봤는데, 최신 모델들이 이렇게 현실적인 결과물을 만들어낼 수 있다는 게 정말 인상적이었어요. 프롬프트를 이해하고 공간적 수정을 하는 능력이 정말 뛰어났거든요. 그런데 간단한 ASCII 이미지를 만들어달라고 하니까 완전히 망했어요. "눈을 만지고 있는 사람의 간단한 ASCII 이미지를 그려줘"라고 했을 때, gemma-4-31b-it은 목을 맨 것처럼 보이는 결과물을 내놨고, grok-4.1-thinking은 그냥 엉망진창이었어요. 복잡한 시각 작업은 잘하면서 가장 기본적인 텍스트 아트에서 실패하다니, 정말 이상하네요.