#reasoning
5 posts tagged
Paper Review07.082026-07-08 09:0021 min read
[AI Search] Language Models Need Sleep: 긴 컨텍스트를 잠자는 동안 압축하는 법
Language Models Need Sleep 논문을 AI Search stack 관점에서 읽는다. 긴 컨텍스트를 매번 attention cache에 들고 가는 대신, eviction 직전에 여러 번의 offline recurrent pass로 SSM fast weights에 통합하는 sleep 메커니즘이 왜 long-context reasoning과 retrieval-augmented agent runtime에 중요한지 정리한다.
Paper Review07.072026-07-07 09:0024 min read
[AI Search] Gemma 4: Open-weight Multimodal Model을 Search Stack에서 읽기
Gemma 4 Technical Report를 AI Search stack 관점에서 읽는다. open-weight multimodal model family가 dense/MoE, encoder-free 12B, thinking mode, long-context KV cache 최적화, quantization, MTP drafter를 통해 검색·에이전트 시스템의 실행 위치와 비용 구조를 어떻게 바꾸는지 정리한다.