快訊
2026-08-25

AI 要聞彙整 2026-08-13:AI 代理疑自主網攻台灣政府

AI 要聞彙整 2026-08-13 刊頭:AI 代理疑自主網攻台灣政府與當日 AI 動態

《金融時報》獨家披露疑與中國有關的攻擊者用開源 AI 代理組成自主駭客工具,入侵至少 85 個台灣政府帳號;SpaceXAI 發布 Grok 4.6,智能指數與 GPT-5.6 Sol 並列、定價維持前代水準;NVIDIA 拉 Google 與微軟推 800 VDC 機房供電架構;奧義賽博與群聯簽約要讓主權 AI「出廠即設防」;Amazon 預設拿 Twitch 內容訓練 AI。五則逐則查證,另有五則快訊。

Mac Continuity Camera 教學:把 iPhone 變成 Mac 的高畫質網路攝影機

Continuity Camera 把 iPhone 架在 Mac 旁當網路攝影機的示範畫面

MacBook 內建鏡頭在背光或夜間就是糊,口袋裡那顆 iPhone 鏡頭其實可以借給 Mac 用。本文照 Apple 官方文件講清接續互通相機的系統需求、連線條件與架設姿勢,並釐清兩個踩雷點:台灣官方把 Desk View 譯成「桌上視角」,以及無線使用時 Mac 不能同時跑 AirPlay 或「並行」。

MULTIPLE_IRP_COMPLETE_REQUESTS(0x44)藍屏怎麼修?揪出重複完成 IRP 的兇手驅動

MULTIPLE_IRP_COMPLETE_REQUESTS 0x44 藍屏停止碼與 IRP 重複完成示意

藍屏跳 MULTIPLE_IRP_COMPLETE_REQUESTS(0x44)先別急著換記憶體。官方講得很清楚:這是某支驅動要求完成一個已經完成的 IRP,而最常見的情況是兩支驅動都以為自己擁有這個封包。本文說明為什麼 !analyze -v 指的模組在這顆碼上特別容易抓錯人,教你用 !irp 攤開封包反推 device stack,再用 Driver Verifier 的 I/O 驗證把違規當場逮住。

LoRA 微調是什麼?QLoRA 不用重新訓練整個模型也能改造 AI 的原理

LoRA 微調低秩分解與 QLoRA 4-bit 量化基座原理示意

看到 LoRA、QLoRA、adapter 就頭大?本文把低秩微調的原理一次講清楚:為什麼兩個小矩陣就能代表整個權重變化、為什麼 B 矩陣要初始化為零、lora_alpha 跟 r 為什麼必須一起調。QLoRA 的 NF4、雙重量化與分頁最佳化器分別省在哪一段也逐項拆解,並整理官方公布的 VRAM 門檻數字,以及自行換算與官方實測之間該留多少餘裕。

科技要聞彙整 2026-08-12:台積電攜 Sony 設熊本合資廠,2029 年產影像感測器

科技要聞彙整 2026-08-12 刊頭:台積電與 Sony 設熊本合資公司 AVSMC、Pixel 11 今晚發表、Zoom 螢幕分享漏洞修補

台積電與 Sony 簽最終協議,於熊本設合資公司 AVSMC,2029 年量產影像感測器;Google 今晚發表 Pixel 11 全系列,規格外觀已幾乎全流出;Zoom 修補三個螢幕分享標註漏洞,最高 CVSS 8.3;傳 SK 海力士重啟大連二廠;三星 Galaxy Buds 助聽功能獲 FDA 核准。五則要聞逐則查證,另有五則快訊。

AI 要聞彙整 2026-08-12:輝達募 5000 億美元做 AI 算力

AI 要聞彙整 2026-08-12 刊頭:輝達 5000 億美元 AI 算力融資與當日 AI 動態

輝達與 Apollo、貝萊德、黑石等六家金融機構簽備忘錄,要以算力為擔保動員逾 5,000 億美元;Anthropic 為 Claude 輸出加入複製貼上仍留痕的隱形浮水印;未發布 Claude 模型把黎曼猜想已證下界由 41.6% 推到 67.2%;SpaceXAI 推常駐代理 Grok Bot;台積電揭 CoWoS 良率 99%、2029 年上看 14 倍光罩。五則逐則查證,另有五則快訊。

一個檔案裡還能藏檔案?NTFS Alternate Data Streams 原理與檢查方法

NTFS Alternate Data Streams 替代資料流檢查示意刊頭,放大鏡圖騰與「一個檔案裡還能藏檔案?」標題

從網路抓回來的腳本被擋、Excel 巨集被封鎖,原因藏在一條你看不到的資料流裡。本文用微軟官方文件拆解 NTFS Alternate Data Streams 的命名規則與機制,說明 Zone.Identifier 怎麼撐起 Office 巨集封鎖,並比較三種檢查方式的能力邊界與該不該刪的判斷。

Speculative Decoding 是什麼?用小模型幫大模型「猜下一個字」為什麼會更快

Speculative Decoding 推測解碼草稿模型與目標模型驗證流程示意

在自己電腦上跑本地 LLM,字總是一個一個慢慢冒出來?Speculative Decoding 的解法很反直覺:讓小模型先猜下一批字,再由大模型一次驗證。本文拆解草稿與驗證兩階段、為何加速卻不掉品質,並用 NVIDIA 與 LM Studio 官方實測說明草稿模型不是越大越好、主模型不夠大時幾乎沒賺頭,以及 llama.cpp 的實際參數怎麼設。

Flash Attention 是什麼?為什麼能讓大模型跑得更快、更省 VRAM

Flash Attention 是什麼 注意力分塊計算與 VRAM 節省原理示意圖

本地跑 LLM 時看到 Flash Attention 這個開關,到底該不該打開?站長把論文與各家原始碼翻過一輪,把中文圈最常弄反的三件事講清楚:它是演算法不是那個 pip 套件、它省的不是模型權重也不是 KV cache、它是 exact 不是近似所以不會讓模型變笨。內含 llama.cpp 與 Ollama 的實際參數、四代版本差異對照,以及消費級顯卡到底吃不吃得到的完整說明。

科技要聞彙整 2026-08-11:TrendForce 估 iPhone 18 Pro 料件成本增 38%

科技要聞彙整 2026-08-11 刊頭:iPhone 18 Pro 料件成本估增 38%、Windows OEM 授權金調漲、RTX 50 系列美國通路漲價

集邦科技估 256GB iPhone 18 Pro 料件成本年增約 38%,記憶體占 BOM 比重一年內由 10% 升至 34%;傳微軟調漲 Windows OEM 授權金 7% 至 10%,消費者版售價不變;三星把 Z Fold8 今年產量目標加碼 100 萬台;RTX 50 系列美國通路中位價最高漲 39%;Valve 通知歐洲客戶物流商 CEVA 遭駭、個資可能外洩。五則要聞逐則查證,另有五則快訊。