[vllm] vLLM, Cohere 임베딩 바이너리 압축 성능 4배 개선: NumPy를 활용한 최적화 분석vLLM에서 Cohere 바이너리 임베딩의 비트 압축 로직을 NumPy로 개선하여 성능을 4배 향상시킨 PR을 분석합니다.#vLLM#성능 최적화#NumPy#임베딩#Python2026년 8월 14일댓글 수 로딩 중