共 73 篇文章包含此標籤
OpenAI 的客戶案例指出,影片 AI 新創 Higgsfield 將 GPT‑6 Astra 同時放入兩條工作流:面
OpenAI 的 Proaction 案例把 AI 導入拆成一條連續的營運鏈:先以 **Codex** 將每場銷售對話轉
Google DeepMind 將 **Live Avatar** 加到 Gemini 3.8 Live:它不是另一個獨
工具型 LLM Agent 不只回答問題,還會搜尋、寫程式、讀取環境資訊並連續採取動作;這也讓它有機會不解決任務本身,卻
OpenAI 的客戶案例指出,網路研究基礎設施公司 Parallel 以 GPT-6 Astra 處理長程資料蒐集任務時
一個 AI Agent 曾經完成任務,不代表它下次仍會完成。Hugging Face 與 IBM Research 以
OpenAI 的案例研究指出,國際律師事務所 Cooley 以 **ChatGPT Work** 建立專有產品 GO P
Cognition 將 GPT-6 Astra 用於自家自主軟體工程師 Devin,重點不只是多寫程式,而是讓它**能替
OpenAI 於 2026 年 9 月公開測試 **Agents API**,把支撐 Codex 的 agent har
OpenAI 在 2026 年 9 月推出 ChatGPT Work 的 **Data agent(資料代理)**:使用
OpenAI 的案例研究指出,法律與專業服務平台 Legora 以 GPT-6 Astra 執行財務報表「勾稽」(tie
Playco 將 GPT-6 Astra 接進自家的 Playbot——一套面向專業遊戲開發者、可直接連結 Unity
Google DeepMind 發布 **Gemini 3.8 Flash** 與專用的 **Gemini 3.8 Fl
OpenAI 的案例研究記錄北美特技巡演公司 ATV Big Air Tour 如何用 ChatGPT Work,讓兩位
2026 年 7 月 9 日,OpenAI 發布 **ChatGPT Work**,這是一個內建 Codex 的工作代理
現代大型語言模型本質上是無狀態的——每次對話都是一張白紙。當 AI Agent 執行橫跨數週、數月的長期任務時,這個缺陷
ScarfBench 是 IBM Research 發布的開放基準測試平台,專門評估 AI 代理在**企業 Java 框
ScarfBench 是 IBM Research 於 2026 年 6 月發布的開放基準,專門評估 AI 代理在企業級
OpenAI 於 2026 年 6 月 25 日發布研究報告,以其內部 Codex 使用數據揭示 AI Agent 如何
CUGA(Configurable Generalist Agent)是 IBM Research 推出的開源代理框架,
Google DeepMind 於 2026 年 6 月 24 日宣布,將「電腦使用(computer use)」功能正
CUGA(Configurable Generalist Agent)是 IBM Research 開源的企業級代理 H
Jason Liu 是 OpenAI Codex 團隊的 Developer Experience Engineer。2
AWS 開源的 **Strands Robots SDK** 與 Hugging Face 的 **LeRobot**
隨著 AI 代理越來越廣泛部署於企業內部系統,如何防範這些代理做出對齊失敗(misalignment)或非預期行為,成為
程式碼代理(code agent)正越來越多地取代人類直接使用軟體函式庫:它們接收任務描述、選擇函式庫、撰寫呼叫程式碼、
傳統 AI Agent 的工具整合採「先安裝、後使用」(install-first, use-later)模式:開發者將
Mitchell Hashimoto 提出的「構建塊經濟」(Building Block Economy)指出:軟體開發
IBM Research 在 2026 年 6 月發表的這篇文章,核心主張只有一句話:**LLM 本身不足以讓企業 AI
Hugging Face 在 2026 年 6 月 4 日發布技術文章,說明如何將 `hf` CLI 重新設計成同時適合
2026 年 6 月,OpenAI Frontiers 系列發布 Endava 案例研究,聚焦這家全球 IT 服務公司如
Pollen Robotics 的桌上型機器人 Reachy Mini 的對話應用,在 2026 年 6 月引入了對 M
Data Formulator 0.7 是 Microsoft Research 於 2026 年 5 月 28 日發布
2026 年 5 月 27 日,OpenAI、Thrive Holdings 與 Crete Professional
AI Agent 領域在過去兩年快速膨脹,帶來的副作用之一是術語混用:「Agent」、「Scaffolding」、「Ha
這篇由 Hugging Face 發布的詞彙指南(2026 年 5 月 25 日)針對 AI Agent 領域中反覆被誤
ITBench-AA 是首個針對**企業 IT 代理任務**設計的評估基準,由 Artificial Analysis
IBM Research 於 2026 年 5 月 18 日在 Hugging Face 發布 **Open Agent
AI Agent 越來越常在社交情境中代表使用者行事——管理行事曆、協商購買、與其他 Agent 互動。這不只需要任務能