
OpenAI 라이브스트림
OpenAI가 라이브스트림 이벤트를 개최합니다. 방송 중에 구체적인 발표, 신제품 출시 또는 시연이 공개될 예정입니다.
The last time OpenAI did an unannounced livestream, they dropped GPT-4 Turbo and changed pricing overnight

누군가 Nvidia의 새로운 NVFP4 압축 기술을 Gemma-4-26B에서 실제로 테스트했는데, 결과가 미쳤다. 모델이 18.8GB까지 줄어들어서 RTX 5090 한 장에 여유 있게 돌아간다. GPU 메모리의 80%만 써서 5만 토큰 컨텍스트 윈도우를 구현했다. 벤치마크는? 거의 안 떨어졌다. AIME는 오히려 올랐고(88.95% → 90%), 나머지도 0.2~0.7% 오차 범위. 보통 이런 압축은 성능을 박살내는데, 이번엔 진짜 공짜 점심이다. 모델은 작고, 똑똑함은 그대로, 속도는 빨라진다. 고성능 오픈소스 모델 원하는데 데이터센터는 안 사고 싶은 사람들한테는 게임 체인저다.