이더리움 창립자 비탈릭 부테린은 트위터를 통해 Qwen 3.8 flash 모델의 성능이 인상적이며 llama.cpp의 처리 능력도 점점 향상되고 있다고 밝혔다. 그는 로컬 모델이 곧 많은 작업을 처리할 수 있게 될 것이며, 더 고급 작업의 경우 로컬 모델을 통해 강력한 모델에 대한 쿼리를 조정하여 개인 정보 유출을 방지하는 방식이 실현 가능해질 것이라고 생각한다.