阿里 AI
通義千問 Qwen 是什麼?阿里的開源大模型家族
通義千問 Qwen 是什麼?阿里的開源大模型家族
你在 Hugging Face、Ollama、LM Studio 這些地方一定看過 Qwen 這個名字。它不是一個模型,是一整個家族。
這篇把這個家族的邏輯講清楚:它是誰做的、有哪些成員、為什麼一代要出這麼多尺寸,以及你可以用哪幾種方式把它用起來。
你將學到什麼
它是什麼
阿里巴巴 Qwen 團隊做的大型語言與多模態模型系列,官方定位是一整個家族而不是單一產品。
家族怎麼分
橫向看用途,語言、視覺、語音各有成員;縱向看尺寸,同一代從小到大一次放出多個版本。
怎麼取得
三條路:呼叫雲端 API、從開源社群下載權重、把權重部署在自己的機器上。
授權怎麼看
開放權重不等於什麼都能做,實際條款一律以該模型官方 repo 裡的授權檔為準。
先把定義說清楚
Qwen 官方文件的自我介紹是:阿里巴巴集團 Qwen 團隊的大型語言模型與大型多模態模型系列。請注意「系列」兩個字,這是理解它的關鍵。
官方列出的能力範圍包含自然語言理解、文字生成、視覺理解、語音理解、工具呼叫、角色扮演與作為 AI Agent 運作。換句話說,它不是只有一顆聊天模型。
家族要用兩個方向來看
第一個方向是用途。語言模型負責對話與推理,視覺類負責看圖與看文件,語音類負責聽與說,另外還有專門做程式碼與做向量嵌入的成員。你要解的問題決定你進哪一條線。
第二個方向是尺寸。同一代模型會一次放出好幾個大小,從筆電或單張顯卡就跑得動的小模型,到需要多張卡才餵得飽的大模型。名稱裡的數字通常就是參數量的標示。
官方 repo 也會同時放出不同架構取向的版本,例如密集模型與混合專家(MoE)架構並存,還有把「思考模式」獨立出來的變體。這些都掛在同一代的名號底下。
開放權重是這個家族最重要的特徵
多數商用大模型你只能透過 API 使用,看不到也拿不到模型本身。Qwen 走的路線不同,相當比例的成員是開放權重,意思是模型參數檔可以公開下載。
這件事的實際差別是:你可以把模型放在自己的機器或自己的雲上跑,資料不必離開你的環境,也不必擔心供應商哪天下架某個版本。
但開放權重不等於沒有規則。每個模型都附有自己的授權條款,能不能商用、有沒有附加義務都寫在裡面。要判斷的時候請直接打開該模型官方 repo 裡的授權檔,以那份文件為準,不要靠二手轉述。
三種把它用起來的方式
| 方式 | 你要做的事 | 適合誰 |
|---|---|---|
| 雲端 API | 在阿里雲的模型服務平台開通、拿金鑰、呼叫 | 想馬上驗證構想、不想碰基礎設施的人 |
| 開源社群下載 | 從 Hugging Face 或 ModelScope 抓權重與設定檔 | 要做實驗、要微調、要離線評估的人 |
| 自架部署 | 用 vLLM、SGLang、Ollama 這類工具把模型跑起來 | 有資料落地要求、或用量大到想控成本的人 |
官方文件對第三條路寫得很詳細,推論、部署、量化、微調各有一整批被支援的工具鏈。這也是這個家族在開發者圈子裡能見度高的原因之一。
實務上怎麼選
我的建議順序是:先用雲端 API 把題目做對,再談要不要自己養。前期你要驗證的是「這個任務用大模型到底可不可行」,這個階段自架只是把時間花在跟顯卡搏鬥。
等到功能穩定、流量可預測、或是有明確的資料不能外流的要求,再回頭評估自架。到那個時候你已經知道自己需要多大的模型,選型會準很多。
延伸學習
做出你的第一個 Skill
一場快閃直播的完整重製。從搞懂 Skill 的五個層級開始,帶你把一件你每天在做的重複工作,寫成一支 AI 真的會照做的 Skill ── 命名、description、輸入拆解、Workflow 訪談、Output 與 Checks,最後組成一份能通過格式檢查的 SKILL.md。
NT$ 999
ChatGPT 很強,但真正讓你下班的是 Google
六小時完整實錄。從「AI 很厲害,為什麼你還是每天加班」這個問題出發,把 Google Workspace 當成真正的工作平台重新設計一次流程 ── Sheets 的資料結構、Drive 與 Docs 的文件流、Gmail 與 Calendar 的通知系統,再用 Apps Script 讓它自己跑起來,最後收斂成一張屬於你自己的 AI 工作能力地圖。
NT$ 4,599

