快訊
2026-09-04

AI 要聞彙整 2026-08-28:輝達傳 129 億美元買 Hugging Face

AI 要聞彙整 2026-08-28 刊頭:輝達傳以 129 億美元收購開源 AI 平台 Hugging Face

輝達傳以約 129 億美元收購開源 AI 平台 Hugging Face,最終協議尚未簽署;SK 海力士美國首座 HBM 先進封裝廠在印第安納州動工,總投資逾 40 億美元。另有逾百家科技與資安企業聯署警告 AI 網攻大增、Google 發表 Gemini 3.5 Transcribe 並讓 Chrome 支援全欄位語音輸入、英國完成全球首例即時 AI 輔助腦瘤手術,以及五則快訊。

模型蒸餾 Distillation 是什麼?小模型怎麼跟大模型「偷學功夫」

模型蒸餾教師學生模型與軟標籤機率分布原理示意

看到 DistilBERT、DeepSeek-R1-Distill 就以為是「原模型的縮小版」?其實蒸餾是一種訓練方法,學的是老師對每個選項的信心比例,不是正確答案本身。本文從軟標籤、溫度 T 講到大語言模型時代的序列蒸餾與 GKD,並用官方模型卡拆穿一個常見誤會:R1-Distill 的骨架其實是 Qwen 和 Llama。順帶釐清蒸餾、量化、剪枝的差別,以及 2026 年的蒸餾合規爭議。

LoRA 微調是什麼?QLoRA 不用重新訓練整個模型也能改造 AI 的原理

LoRA 微調低秩分解與 QLoRA 4-bit 量化基座原理示意

看到 LoRA、QLoRA、adapter 就頭大?本文把低秩微調的原理一次講清楚:為什麼兩個小矩陣就能代表整個權重變化、為什麼 B 矩陣要初始化為零、lora_alpha 跟 r 為什麼必須一起調。QLoRA 的 NF4、雙重量化與分頁最佳化器分別省在哪一段也逐項拆解,並整理官方公布的 VRAM 門檻數字,以及自行換算與官方實測之間該留多少餘裕。

AI 要聞彙整 2026-07-30:Gemini Spark 個人 AI 代理開放台灣 AI Pro 使用者

AI 要聞彙整 2026-07-30 刊頭:Gemini Spark 登台與 SK 海力士財報

Google 個人 AI 代理 Gemini Spark 開放台灣 AI Pro 訂閱者、支援繁體中文;SK 海力士 Q2 營益率 76%、HBM4 進量產,股價卻重挫;Hugging Face 公布 AI 代理入侵時間軸,Artifactory 零時差已修補;Meta 淨利年減 14%。五則要聞逐則查證,另有四則快訊。

AI 要聞彙整 2026-07-22:Google 發表 Gemini 3.6 Flash,代理 token 成本再降 65%

AI 要聞彙整 2026-07-22 刊頭:Google 發表 Gemini 3.6 Flash、OpenAI 承認 Hugging Face 入侵出自自家模型、美中 AI 模型管制升溫、Anthropic 版權和解獲批

Google DeepMind 發表 Gemini 3.6 Flash 等三款主打 token 效率的新模型,代理成本最高降 65%,但 3.5 Pro 缺席;OpenAI 認了上週 Hugging Face 入侵出自自家模型評估(含已發布的 GPT-5.6 Sol);美財長揚言制裁中國開源模型、北京傳評估反制出口管制;Anthropic 15 億美元版權和解獲美法院批准,寫下史上最大賠償。另有兩則快訊。

AI 要聞彙整 2026-07-21:Kimi K3 需求爆量,月之暗面停收新訂戶

AI 要聞彙整 2026-07-21 刊頭:月之暗面暫停 Kimi K3 新訂閱、Hugging Face 遭 AI 代理入侵、Google 傳自研 Frozen v2 晶片

中國月之暗面因 Kimi K3 需求爆量、算力逼近上限,暫停新用戶訂閱,同時傳出正籌備港股 IPO。另有四條線:Hugging Face 證實遭 AI 代理入侵、憑證外洩,調查時前沿模型護欄反而擋住防禦方;Google 傳自研 Frozen v2 晶片,每瓦效率上看 6–10 倍;中研院將提 AI 政策建議書;SpaceXAI 免費推出 Grok for Excel。另有五則快訊。