Threads (@94eheima)
local-llmai-engineering
Original source

Qwen3-Embedding-0.6B 輕量向量模型玩法

Summary

  • Qwen3-Embedding-0.6B 是超輕量向量模型,僅 0.6B 參數,量化版只佔 610MB
  • CPU 載入即可跑,不需 GPU
  • 用途不止 RAG,還可做:文字分類、相似度比對、程式碼搜尋、跨語言搜尋
  • GGUF 格式也有提供(huggingface.co/Qwen/Qwen3-Embedding-0.6B-GGUF)
  • 適合算力已滿載但還想加知識庫語意搜尋的場景
  • 支援中英文混搭工作環境
  • HuggingFace 下載量已達 700 萬+