大型語言模型

Qwen3.8 27B 開源模型一次看懂:規格、跑分到本地實測

Qwen3.8 27B 是 Qwen3.8 系列唯一的 dense 開放權重模型,採 Apache 2.0 授權、能直接讀圖片與影片。這篇先介紹它的混合注意力架構、思考模式與模型卡分數,再用 RTX 3060 12GB 本地實測數學、程式、長文與 Hermes Agent 代理任務,整理它擅長與會出錯的地方。

Qwen3.8 27B 12GB 跑得動嗎?RTX 3060 搭 llama.cpp 的實測參數

Qwen3.8 27B 12GB 能不能跑,是手上只有 12GB 顯卡的人最先想知道的事。我們用 RTX 3060 搭 llama.cpp 實測兩天,整理量化檔選擇、llama-server 啟動參數、首次請求顯存不足的修法,以及 64K 上下文、生成速度、取樣參數與思考深度在慢硬體上的時間取捨。

AI Agent 運作原理:拆解「想、做、看、修正」迴圈

AI Agent 運作原理,其實就是一套不斷「想、做、看、修正」的迴圈:接到目標先規劃,呼叫工具碰到真實世界,看懂結果不如預期就重新調整方向再出發,不是一次生成就結束的問答機。這篇用訂機票的情境,把五個關鍵步驟一次拆給你看。

Kimi K3 是什麼?2.8 兆參數開源模型介紹

Kimi K3 是 Moonshot AI 在 2026 年 7 月發布的旗艦模型,以 2.8 兆參數成為目前最大的開放權重模型,同時具備推理與多模態能力。這篇帶你認識它的架構設計、實測成績,以及現在能怎麼開始使用它。

LLM 大型語言模型是什麼?搞懂它只是在猜下一個字

LLM 大型語言模型是什麼?其實它不是真的「聽懂」你的問題,而是在海量文字上訓練出來、專門預測下一個字的機率模型,一路猜、一路接,才拼出讀起來像懂你的完整回答,搞懂這套機制,才能看懂 ChatGPT、Claude、Gemini 背後共通的原理。

AI 語音助手上車後,開口講話跟以前差在哪?

AI 語音助手把大型語言模型接進車機後,開口講話的規則跟以前完全不一樣:不用再背固定指令、講感覺它也懂、上一句還記得住。這篇用空調、路況、多輪對話等具體行車情境,帶你看清楚跟舊系統的差別,也把它的限制一次說明白。

Llama 是什麼?從定位、版本演進到實務落地一次看懂

Llama 模型是 Meta 推出的可部署語言能力底座,定位偏向基礎建設而非現成產品,適合需要自主治理資料流向與流程控制的場景。涵蓋各世代版本差異、模型大小選型邏輯,以及任務規格化、資料供應與評測迭代等工程落地重點,協助評估語言模型導入時做出符合實際代價的決策。