Gemini機器人2.0:影片理解驅動任務調度與多機協作

AI 新聞快訊:Gemini Robotics ER 2是Google DeepMind推出的機器人專用模型升級版,聚焦於強化機器人在真實環境中的「推理」與「協作」能力。核心突破在三個面向:首先是影片理解能力大幅提升,讓機器人能更精準解析動態場景與物體互動關係,而非僅依賴靜態影像判斷;其次是工具調度(tool or…

2026-07-30 · 1 分鐘 · 40 字 · Judy

GPT-5.6:性價比與效能雙提升的最新突破

AI 新聞快訊:OpenAI 推出更具價格效益的 GPT-5.6 模型版本 Luna 與 Terra,相較先前版本大幅降低使用成本,目標是讓企業能以更低門檻在生產環境中規模化部署 AI 工作流程。這兩款模型延續 OpenAI 在「價格與效能前緣(price-performance frontier)」上的推進方向,…

2026-07-30 · 1 分鐘 · 53 字 · Judy

啟用兩項設定,ARC-AGI-3基準測試分數翻三倍

AI 新聞快訊:OpenAI 發現只要調整兩個 API 設定,就能讓 GPT-5.6 在 ARC-AGI-3 測試中的分數大幅提升,同時改善效率。第一個設定是保留推理過程(retaining reasoning),讓模型在多輪互動或多步驟任務中,能延續先前的推理鏈,而不是每次都從零開始重新思考,這樣可以維持邏輯連貫…

2026-07-30 · 1 分鐘 · 44 字 · Judy

加速學術研究者運用ChatGPT推動科學發現進展

AI 新聞快訊:OpenAI宣布向10萬名學術研究人員免費開放ChatGPT最先進AI模型的使用權限,目的是加速科學研究、跨機構協作與學術發現進程。此舉讓研究人員無需負擔訂閱費用,即可運用OpenAI旗下頂尖模型輔助文獻整理、假說推演、數據分析等研究流程,有機會降低學術界導入先進AI工具的門檻,並促進跨領域研究團隊…

2026-07-29 · 1 分鐘 · 30 字 · Judy

AI 模式搜尋助你享受真實世界的5種方式

AI 新聞快訊:這則是 Google Search AI Mode 功能介紹文,非交易/系統類任務,直接產出摘要即可。 Google 部落格文章介紹 Google 搜尋中的 AI Mode 如何幫助使用者更多走出戶外、體驗真實生活。文章指出,今年民眾搜尋「成人網球課」「越野跑」「健行」「跑步社團」等關鍵字創新高,…

2026-07-28 · 1 分鐘 · 51 字 · Judy

Gemini API 託管代理上線:3.6 Flash 與 Hooks 功能全面解析

AI 新聞快訊:Gemini API 的 Managed Agents 功能推出三項更新:模型升級、環境掛鉤(hooks)、免費層存取。這建立在先前推出的背景任務與遠端 MCP 伺服器整合基礎之上。透過 Gemini Interactions API,單一 API 呼叫即可協調推理、程式碼執行、套件安裝、檔案管理與…

2026-07-28 · 1 分鐘 · 98 字 · Judy

科學運算迎來智能代理時代:AI驅動的科研工具革新

AI 新聞快訊:AI 開發者 OpenAI 近日發布一份新的實地報告,說明科學家如何運用 AI 程式編寫代理(AI coding agents)來現代化科學計算領域的軟體開發流程,藉此加速基因體學(genomics)等領域的軟體開發與科學發現進程。報告指出,這類 AI 代理能協助科學家處理原本繁瑣的程式撰寫與維護工…

2026-07-28 · 1 分鐘 · 45 字 · Judy

AI改變了人們工作方式的實際樣貌

AI 新聞快訊:OpenAI 最新研究揭示了 AI 如何擴大工作者的職責範圍,透過分析 ChatGPT 使用者的實際互動資料,發現員工正跨越原本職務邊界承接更多樣化的任務。研究顯示,使用者不再侷限於單一崗位所定義的工作項目,而是利用 ChatGPT 處理原本可能屬於其他角色或部門的任務,例如非技術背景的員工開始涉入…

2026-07-27 · 1 分鐘 · 44 字 · Judy

長期地平線模型下的安全與對齊挑戰

AI 新聞快訊:OpenAI 分享了部署長時運行(long-running)AI模型的實務經驗,內容聚焦於這類模型在實際運作中出現的新型安全風險、觀察到的失敗案例,以及透過反覆迭代部署所改善的防護機制。由於這類模型會在較長時間跨度內自主執行任務、累積脈絡並持續與環境互動,相較於單次問答式的模型,其風險樣態與傳統安全…

2026-07-20 · 1 分鐘 · 31 字 · Judy

AI時代成績單:各大機構如何評估AI能力發展

AI 新聞快訊:OpenAI財務長Sarah Friar提出一套實用的AI投報率評分卡,用來衡量企業導入AI後的實際效益,而非僅憑感覺判斷。該評分卡聚焦四個面向:一是「有用的工作量」,即AI實際完成了多少能產生價值的任務;二是「每次成功任務的成本」,也就是把AI運算與人力投入換算成每完成一項任務所需的花費,藉此與傳…

2026-07-17 · 1 分鐘 · 32 字 · Judy
訂閱 AI 週報,每週精選新知:

AI 工程、交易系統、自動化實戰 — 一週一封,不灌水。