MosaicLeaks研究:AI研究代理人真的能保守機密嗎?

AI 新聞快訊:MosaicLeaks 是一項針對「深度研究型 AI 代理隱私洩露」的新研究,揭示了一個被稱為「馬賽克效應」的隱患:當代理同時存取本地私有文件與外部網路工具時,每一筆看似無害的搜尋查詢,累積起來卻可能讓旁觀者拼湊出企業機密。 研究以一家醫療機構為例說明:代理為完成一個多步驟問題,先後查詢雲端遷移里…

2026-06-19 · 1 分鐘 · 79 字 · Judy

透過 Strands Agents 與 LeRobot 將 Hugging Face Hub 模型部署至實體機器人硬體

AI 新聞快訊:AWS 開源了 Strands Robots SDK(Apache 2.0 授權),與 Hugging Face 的 LeRobot 框架深度整合,目標是打通機器人從示範資料蒐集到實體硬體部署的完整流程。過去這條路需要五套獨立工具分別處理錄製示範、訓練模型、模擬測試、硬體部署與多機協調,各工具彼此無…

2026-06-17 · 1 分鐘 · 121 字 · Judy

AI 代理串接兩個 Hugging Face Space 自動生成巴黎3D藝廊

AI 新聞快訊:一位開發者讓程式代理人獨立完成了巴黎地標 3D 展示網站的全部資產製作,整個過程沒有手動開啟任何圖像生成工具或 3D 重建軟體。代理人透過直接串接兩個 Hugging Face Space 完成任務:首先呼叫 ideogram-ai/ideogram4,以文字提示將每座地標轉換為黑底標本風格的清晰圖…

2026-06-09 · 1 分鐘 · 131 字 · Judy

打造巴基斯坦通知助手:用 AI 解決在地安全通報問題

AI 新聞快訊:Pakistan Notice Helper 是一款針對巴基斯坦本地詐騙訊息問題開發的小型 AI 安全工具,由開發者在「Build Small」黑客松 Backyard AI 賽道中完成。巴基斯坦用戶長期收到偽裝成銀行、快遞公司、稅務機關、電信業者或政府部門的可疑訊息,辨別真偽本身並非難點,難的是在…

2026-06-08 · 1 分鐘 · 80 字 · Judy

三十億參數小模型上跑多智能體經濟系統 Thousand Token Wood 實戰報告

AI 新聞快訊:「千代木」(Thousand Token Wood)是一個提交給 Build Small Hackathon 的多智能體經濟模擬系統,採用 Qwen2.5-3B 小型模型,驅動五隻森林動物角色在虛構市場內交易五種商品換取石子貨幣。整個系統以 vLLM 部署在 Modal 上,前端使用 Gradio,…

2026-06-06 · 1 分鐘 · 102 字 · Judy

Nemotron 3.5 內容安全:為全球企業 AI 打造可自訂的多模態防護機制

AI 新聞快訊:NVIDIA 發布 Nemotron 3.5 Content Safety,這是一款專為企業 AI 應用打造的多模態安全分類器,底層基於 Google Gemma 3 4B 搭配 LoRA 微調而成,僅需 8GB 以上 VRAM 即可部署。與前代最大的差異在於「統一多模態評估」:模型能在單次推理中同…

2026-06-05 · 1 分鐘 · 107 字 · Judy

EVA-Bench Data 2.0 評測基準發布:涵蓋3大領域、121項工具與213個測試場景

AI 新聞快訊:ServiceNow AI 研究團隊發布 EVA-Bench Data 2.0,這是一套專為語音 Agent 設計的企業級評測基準,此次大幅擴充規模,從原本單一領域擴展為三大企業場景:航空客服管理(CSM)、企業 IT 服務管理(ITSM),以及醫療人力資源服務交付(HRSD)。三個領域合計涵蓋 2…

2026-06-04 · 1 分鐘 · 93 字 · Judy

以任務為種子的合成問答資料生成技術用於 Nemotron 預訓練

AI 新聞快訊:NVIDIA 針對 Nemotron 系列模型開發出「任務種子合成資料生成」(Task-Seeded SDG)五階段流程:從 lm-eval-harness 選取約 70 個公開任務(約 700 子任務),分為知識密集型(39 任務、約 300 萬筆)與推理密集型(34 任務、約 150 萬筆)兩類…

2026-06-04 · 1 分鐘 · 83 字 · Judy

超越大型語言模型:企業 AI 大規模落地的關鍵在於智能代理邏輯

AI 新聞快訊:IBM Research 發表研究指出,企業 AI 規模化落地的關鍵不在於更大的 LLM,而在於「Agent Logic」——即知識圖譜、程式靜態分析、演算法分解等軟體原語所構成的引導層。這套機制能壓縮 LLM 的上下文空間,同步降低幻覺率與 Token 消耗,使模型行為更可控、成本更可預測。 研…

2026-06-01 · 1 分鐘 · 79 字 · Judy

JetBrains 發布 Mellum2:120億參數混合專家架構開發者專用模型

AI 新聞快訊:JetBrains 於 2026 年 6 月 1 日發布 Mellum2,這是一款基於混合專家架構(MoE)的 120 億參數開源模型,但每次推論僅啟動其中 25 億個活躍參數,使推論速度比同規模模型快逾兩倍,部署成本顯著降低,採用 Apache 2.0 授權公開釋出。 Mellum2 定位並非取…

2026-06-01 · 1 分鐘 · 62 字 · Judy
訂閱 AI 週報,每週精選新知:

AI 工程、交易系統、自動化實戰 — 一週一封,不灌水。