아래로 당겨서 돌아가기
llama.cpp에 속도 향상 기능이 추가됐는데, 항상 효과가 있는 건 아니네요

llama.cpp에 속도 향상 기능이 추가됐는데, 항상 효과가 있는 건 아니네요

llama.cpp just got a speed hack that might make your AI faster (or not)

로컬에서 AI 모델을 실행할 수 있는 llama.cpp에 '추측 체크포인팅'이라는 새로운 기능이 추가되었습니다. 이론상으로는 처리 속도가 빨라져야 하는데, 실제로는 결과가 들쭉날쭉합니다. 어떤 프롬프트는 50% 빨라지지만, 어떤 것은 전혀 효과가 없어요. 코딩 작업에서는 꽤 괜찮은 개선이 보였지만, 반복이 많은 프롬프트나 AI가 예측을 자꾸 거부하는 경우에는 기대하기 어렵습니다. 결국 작업 유형에 따라 파라미터를 조정해야 한다는 뜻입니다. 만능 해결책은 아니지만, 로컬에서 AI를 사용하는 사람이라면 한 번 시도해볼 가치가 있습니다.