共 31 篇文章包含此標籤
Google DeepMind 將 **Live Avatar** 加到 Gemini 3.8 Live:它不是另一個獨
LeRobot v0.6.0 於 2026 年 7 月 7 日發布,以「想像(Imagine)、評估(Evaluate)
Photoroom 在 Hugging Face 部落格發表的 PRX 系列第四篇,詳述他們訓練自家文字生成圖像模型(P
Google DeepMind 於 2026 年 6 月 30 日發布兩款針對速度與成本優化的生成式 AI 模型:**N
Google DeepMind 於 2026 年 6 月 24 日宣布,將「電腦使用(computer use)」功能正
Gemini 3.5 Live Translate 是 Google DeepMind 於 2026 年 6 月 9 日
Mitchell Hashimoto 提出的「構建塊經濟」(Building Block Economy)指出:軟體開發
NVIDIA 於 2026 年 6 月在 Hugging Face 發布 Nemotron 3.5 Content Sa
Hugging Face 於 2026 年 5 月 27 日發布的這篇教學,示範如何讓 **Reachy Mini**(
醫療 AI 的下一個演化方向,不再只是預測(「這位患者未來 30 天住院風險是 X%」),而是理解**因果**(「是哪個
隨著生成式 AI(AIGC)技術快速演進,合成圖像在解析度與語意一致性上已逼近真實照片,使人眼辨識幾乎不可能。傳統 De
2026 年 5 月 7 日,OpenAI 在 API 中推出三個全新即時語音模型,標誌著語音 AI 從「呼叫—回應」模
NVIDIA Nemotron 3 Nano Omni 是 Nemotron 多模態系列的最新一代,從原本的視覺語言模型