梅森

AI報報報

《AI報報報》是一檔 每天更新、專為忙碌的你打造的 AI 新聞快報節目。給你沒聽過但快爆紅的 AI 趨勢,我們都用 最精簡、最有料、最有趣的方式報給你聽。 每天只要 3~5 分鐘,帶你掌握全世界的 AI 新聞,上班、吃飯、搭車都能聽,一點也不浪費時間。 跟上 AI 時代,從《AI報報報》開始! 🔔 記得訂閱,天天都有新消息! Powered by Firstory Hosting

Author

梅森

Category

Technology

Podcast website

open.firstory.me

Latest episode

Jun 10, 2025

Where to listen?

Podcasts in the app Replaio Radio Coming soon

Podcasts are coming to the app soon. Install now and be the first to see a whole new take on podcasts

Get it on Google Play Install for free Android almost 10M downloads · 4.8 rating iOS soon

Episodes

EP-60 紅杉資本:這次市場規模比雲端轉型大一個數量級,學會「隨機性思維」與「管理 AI Agents」」 22.05.2025

加入免費會員,更新資訊不漏接: https://open.firstory.me/join/cma3mukjr127j01w5h4m56giw 小額贊助支持本節目: https://open.firstory.me/user/cma3mukjr127j01w5h4m56giw 留言告訴我你對這一集的想法: https://open.firstory.me/user/cma3mukjr127j01w5h4m56giw/comments Powered by Firstory Hosting

EP-59 Google I/O '2025 主題演講 21.05.2025

 Google I/O 大會的演講稿,內容圍繞著 Google 在人工智慧 (AI) 領域的最新進展。演講者詳細介紹了 Gemini 模型的性能提升、應用擴展以及其在 搜尋、影像生成、影片創作、機器人等方面的整合。此外,演講稿也涵蓋了 AI 驅動的新產品和功能,例如 Project Starline 的 Beam 視訊通訊平台、Project Astra 的通用 AI 助理、Project Mariner 的網路互動代理,以及針對開發者的 AI 工具和 API。最後...

EP-58 Google 開發的全新 AI 製片工具Flow 21.05.2025

是一款由 Google 開發的全新 AI 製片工具,專為搭配其先進模型 Veo、Imagen 和 Gemini 使用而設計。Flow 旨在透過提供如攝影機控制、場景建構器和資產管理等功能,協助創作者輕鬆製作出具電影感的短片和場景。此工具是 VideoFX 的演變,目前已開放給訂閱 Google AI Pro 或 Ultra 方案的美國使用者,未來將陸續開放給更多國家。此外,Google 也與多位電影製作人合作,探索 AI 在電影敘事中的潛...

EP-57 微軟Microsoft Build 2025 強調人工智慧為開發者帶來的新平台轉變 21.05.2025

微軟執行長薩蒂亞·納德拉在 Build 2025 開場演講中,強調人工智慧(AI)為開發者帶來的新平台轉變。他深入探討了包括 GitHub Copilot 在內的 AI 工具如何提升開發者效率,並宣布 Microsoft 365 Copilot 的最新進展,特別是在代理程式和多代理程式協調方面的突破。演講還介紹了 Azure AI Foundry,作為支援各類 AI 工作負載的全面應用程式伺服器,並宣布與 OpenAI、Mistral 和 XAI 等公司在模型選擇和基礎...

EP-56 Google NotebookLM 的 Sparks 影片 20.05.2025

 Google NotebookLM 將推出的新功能 「Sparks」影片摘要,此功能旨在將使用者文件或研究報告自動轉換為短影片。 文章指出,此項技術仰賴 Gemini2.5Pro 的多模態能力以及 Deep Research 功能,能夠快速生成包含文字、圖片和音訊的結構化影片。 報導也分析了「Sparks」在 教育、研究與內容創作 等多個領域的應用潛力及其對 AI內容生成 領域的影響,同時提及可能引發的版權與...

EP-55 OpenAI Codex 程式設計應用與指南 20.05.2025

 OpenAI Codex,這是一個用於理解和產生程式碼的 AI 模型,是 GPT-3 的一個變種。 文章解釋了 Codex 的工作原理,包括它如何處理自然語言提示、預測程式碼序列以及從大量資料中學習模式。 多個來源都強調 Codex 的多功能性,可用於程式碼生成、自動完成、偵錯、解釋和自動化任務,支援多種程式語言。 然而,這些文章也指出了一些限制,例如可能生成帶有錯誤或安全問題的程式碼,以及訓練資料的時效性。 最後,資源概述了存取...

EP-54 黃仁勳2025 COMPUTEX 談論台灣AI產業的夥伴關係 20.05.2025

加入免費會員,更新資訊不漏接: https://open.firstory.me/join/cma3mukjr127j01w5h4m56giw 小額贊助支持本節目: https://open.firstory.me/user/cma3mukjr127j01w5h4m56giw 留言告訴我你對這一集的想法: https://open.firstory.me/user/cma3mukjr127j01w5h4m56giw/comments Powered by Firstory Hosting

EP-53 Telegram快讀助手:telegram link summarizer agent,它可以總結聊天中分享的各種鏈接,提取內容並產生簡潔摘要 20.05.2025

**Telegram快讀助手:telegram link summarizer agent,它可以總結聊天中分享的各種鏈接,提取內容並產生簡潔摘要** 有人發鏈接,它就幫你讀,快速告訴你鏈接內容說了什麼,輔助判斷是否需要深讀。例如一些資訊群、學習群,或是內容量比較大的工作群就可以用它輔助 基本各種連結都可以,支援總結網頁文章、PDF文件、推特/LinkedIn帖子,以及YouTube影片等等 智慧路由,可自動辨識連結類型選擇適合的處理方式 github: https://gith...

EP-52 AI智能體的行為快取系統:Muscle-mem,能讓智能體記住重複任務,減少重複調用LLM,可以與現有Agent系統集 20.05.2025

**AI智能體的行為快取系統:Muscle-mem,能讓智能體記住重複任務,減少重複呼叫LLM,可以與現有Agent系統整合** 相當於給智能體加了個大腦,幫它記住之前做過的事,當智能體接到任務時,它會先檢查記憶庫,如果之前做過,就直接按照之前記錄步驟去做;如果是新的任務,就會把任務交給智能體處理 核心是它的驗證機制,並不是簡單復用所有先前的操作,它會判斷這個記憶是不是真的適合現在的任務,如果任務的某些關鍵訊息變了,就不能...

EP-51 一款具備自我進化能力的多智能體自動化系統:EvoAgentX,對需要持續優化及多步驟協作的複雜AI應用場景非常適用 20.05.2025

**一款具備自我進化能力的多智能體自動化系統:EvoAgentX,對需要持續優化及多步驟協作的複雜AI應用場景非常適用** 比如說,醫療診斷輔助、科研助理、電商平台訂單處理、自動化客服、個人化推薦、履歷智能職缺推薦、股票視覺分析等等 EvoAgentX是一款具備自動工作流程產生、任務排程執行、且整合了MCP能力的多智能體系統工具 除了構建,核心在於它透過整合多種演化演算法,可以自動調整智能體的參數、優化工作流程結構,使AI智能體...

EP-50 整合了RAG、MCP的多智能體無程式碼建構工具:open-agent-platform,圖形化操作,適合無程式快速原型 20.05.2025

**整合了RAG、MCP的多智能體無程式碼建構工具:open-agent-platform,圖形化操作,適合無程式快速原型** 可以用它做例如,自動化相關任務,資料分析、個人/研究助理、智慧客服、個人化推薦,或企業內部知識庫等等 可透過介面建立和管理智能體,設定智能體的行為、回答風格、處理邏輯等等,可與智能體即時交互,測試共響應與功能,支援擴展 github: https://github.com/langchain-ai/open-agent-platform 加入免費會員,更新資訊不...

EP-49 一款專用於數學建模的AI助理:Math Model Agent,給它題目,它可以完成從問題分析、建立模型、寫程式碼、寫論文等全流程 18.05.2025

**一款專用於數學建模的AI助理:MathModelAgent,給它題目,它可以完成從問題分析、建立模型、寫程式碼、寫論文等全流程** 它是一個多Agent協作系統,包括負責數學建模的agent、編寫/調試程式碼的agent、論文撰寫的agent 支援不同AI模型,內建了本地程式碼解釋器,可以直接運行和調試生成的程式碼 適用於輔助數學建模比賽、輔助做數學建模研究,或是做數據分析等等 github: https://github.com/jihe520/MathModelAgent 加入免費會...

EP-48 新出的一款整合了瀏覽器操作、MCP、自動工具呼叫、任務規劃、深度研究等多種能力的智慧體框架:minion-agent 18.05.2025

**新出的一款整合了瀏覽器操作、MCP、自動工具呼叫、任務規劃、深度研究等多種能力的智慧體框架:minion-agent** 它的能力在於比如說,8分鐘自動收集了35篇文章,生成6頁的詳細分析報告;自動訪問網站提取定價信息,生成結構化的價格比較表,輔助市場調查等等 好比AI助理製作套裝,告訴它要做什麼,它就能自動完成像網站互動、工具使用、計畫、研究等複雜任務 支援多種AI模型,可以隨時增加新功能,能和各種工具一起使用 用它做科...

EP-47 arXiv論文摘要產生器:arxiv_summarizer,給一個arXiv連結或關鍵字,指定日期範圍,讓它去arXiv上幫你找到對應的論文並總結 17.05.2025

**arXiv論文摘要產生器:arxiv_summarizer,給一個arXiv連結或關鍵字,指定日期範圍,讓它去arXiv上幫你找到對應的論文並總結** 也可以設定自動運行,讓它每天找新的相關論文,並把總結發到你的Google文件裡 支援單篇或批量處理,對於需要瀏覽大量論文的研究人員或學生比較有用 github: https://github.com/Shaier/arxiv_summarizer 加入免費會員,更新資訊不漏接: https://open.firstory.me/join/cma3mukjr127j01w5h4m56giw 小...

EP-46 Qwen3的Agent能力使用指南!透過Qwen-Agent讓Qwen3模型無縫調用MCP Server,一鍵將文件轉換為結構化的心智圖 17.05.2025

**Qwen3的Agent能力使用指南!透過Qwen-Agent讓Qwen3模型無縫調用MCP Server,一鍵將文件轉換為結構化的心智圖** 範例中展示了從檔案讀取、智慧編號到心智圖轉換,Qwen-Agent透過Qwen3呼叫MCP Server服務的全流程,程式碼請見下方 另外還有基於自然語言操作資料庫、即時智慧地圖服務兩個範例,可以拿來做快速原型開發,修改擴展,或練手使用 CookBook: 資料庫操作: https://github.com/QwenLM/Qwen-Agent/blob/main/examples/coo...

EP-45 一款具備情緒表達的說話者影片產生工具:DICE-Talk,具備多元的情緒表現 16.05.2025

**復旦大學與騰訊放出來的一款具備情緒表達的說話者影片產生工具:DICE-Talk,具備多元的情緒表現** 從效果看身份特徵保持的很好,可以用來做創意短視頻 它把身分和情感分開處理,確保表情改變時樣貌不變,並協同處理情感關係,不同情感間自然過渡,避免表情跳變 基於音頻驅動面部動畫的生成,根據音頻中的語音和情感信息,自動生成對應的面部表情和口型動作,口型同步保持的可以 github: https://github.com/toto222/DICE-Talk...

EP-44 谷歌等搞的一款影像光源控制系統:LightLab,它的能力不光是可以控制環境光,不一樣的是能控制局部光,還可以增加局部虛擬光 16.05.2025

**Google等搞的一款影像光源控制系統:LightLab,它的能力不光是可以控制環境光,不一樣的是能控制局部光,還可以增加局部虛擬光** 從單張圖片即可實現光源控制能力,從效果看光線變化、以及陰影/反光效果比較自然,每個光源都可以獨立控制 功能上,可以控制可見光源,比如說圖片中有一盞檯燈,就可以控制這盞檯燈的亮度、顏色以及位置 比方說你想在圖片中增加新光源,點選放置位置系統自動建立光源 調整環境光,可以調整圖片整體...

EP-43 一種新的醫學技術,由加州理工學院的團隊開發,深層組織活體聲音列印 (DISP),能夠在活體動物體內深處的特定位置3D 列印聚合物。 16.05.2025

描述了一種新的醫學技術,由加州理工學院的團隊開發。這種技術被稱為深層組織活體聲音列印 (DISP),能夠在活體動物體內深處的特定位置3D 列印聚合物。這項創新利用超聲波來定位,並透過低溫敏感脂質體釋放交聯劑來引發聚合物形成。DISP 平台具有廣泛的潛在應用,包括選擇性藥物輸送、封閉內部傷口,甚至監測生理訊號。 https://www.caltech.edu/about/news/3d-printing-in-vivo-using-sound 加入免費會員,更新資訊不漏接: https:...

EP-42 馬斯克利用這次訪問推廣其公司的技術,包括Starlink、Optimus機器人、自動駕駛汽車和Boring Company隧道,並與沙烏地官員簽署了協議 16.05.2025

加入免費會員,更新資訊不漏接: https://open.firstory.me/join/cma3mukjr127j01w5h4m56giw 小額贊助支持本節目: https://open.firstory.me/user/cma3mukjr127j01w5h4m56giw 留言告訴我你對這一集的想法: https://open.firstory.me/user/cma3mukjr127j01w5h4m56giw/comments Powered by Firstory Hosting

EP-41 GoogleDeepmind搞了個用於高階演算法設計的AI程式智能體:AlphaEvolve,其幫Google資料中心節省了0.7%算力 15.05.2025

GoogleDeepmind搞了個用於高階演算法設計的AI程式智能體:AlphaEvolve,其幫Google資料中心節省了0.7%算力 AlphaEvolve結合了LLM的創造力和自動化評估器的能力,可以編寫和不斷優化複雜演算法,不僅能產生單一函數,還能進化整個程式碼庫,開發更複雜的演算法 它也把Gemini架構中的核心運算效率提高了23%,使訓練時間減少了1%;在數學領域,發現了新的矩陣乘法演算法,在多個開放性數學問題上取得了進展 這個工具目前還沒有開放,...

EP-40 利用OpenMemory MCP,為AI工具加上一個可共享的大腦,讓AI工具可以記住並分享互動前的信息,保持上下文,本地運行 15.05.2025

**利用OpenMemory MCP,為AI工具加上一個可共享的大腦,讓AI工具可以記住並共享互動前的信息,保持上下文,本地運行** 也就是說,你用不同的AI工具設計了一個遊戲角色,你需要修改角色的某個屬性,只要在OpenMemory MCP中修改一次,所有使用該資訊的AI工具就會更新,不用逐一修改 相容於Cursor、Claude Desktop、Windsurf、Cline等 資料儲存在本機上 有集中式儀表板,可查看與控制 github: https://github.com/mem0ai/mem0 加入免...

EP-39 Lovart 是一款號稱是全球首個設計代理的應用程式 14.05.2025

Lovart 是一款號稱是全球首個設計代理的應用程式,旨在簡化整個設計流程,將想法轉化為專業設計。該平台能夠自動化數百項決策,模仿專業設計師的創意和直覺。從概念到成品,Lovart 能夠分解設計需求、進行網路搜尋以獲取參考資料、建立設計概念,並選用工具(如平面風格)來生成標誌和顏色調色盤。它還能尋找合適的字體並建立客製化排版,甚至在幾分鐘內生成品牌視覺形象。此外,Lovart 還具備編輯和智慧生成功能,使用者可以...

EP-38 VIDEOMIMIC,一種將人類的日常影片轉換為人形機器人可用的情境感知技能的系統。 14.05.2025

這些資料描述了 VIDEOMIMIC,一種將人類的日常影片轉換為人形機器人可用的情境感知技能的系統。 VIDEOMIMIC 管道首先從單眼影片共同重建人類動作和周圍環境,然後將這些動作重塑並轉化為適合機器人使用的訓練資料。接著,這個資料被用於訓練一個強化學習策略,使機器人能夠根據感測到的地形和指令,在實際環境中執行各種動作,例如爬樓梯或坐在椅子上,而無需手動編寫程式或設定獎勵。最終,這項技術為人形機器人提供了一種可...

EP-37 微軟宣布支援A2A協議 AI技術又迎來另一行業標準,開放式 A2A 協定 10.05.2025

Microsoft 部落格文章討論了人工智慧代理程式的興起及其在企業中的重要性,強調了對於這些代理程式之間進行協作的需求。 文章介紹了即將推出的 Agent2Agent (A2A) 開放協定,它將整合至 Azure AI Foundry 和 Copilot Studio 中,旨在促進代理程式跨平台和雲端環境進行互通。 A2A 協定的目標是實現代理程式之間的結構化溝通,包括目標交換、狀態管理和動作呼叫。 Microsoft 強調了對於開放協定的承諾,並...

EP-36 Config 2025最強更新 Figma Sites打造設計與建站無縫整合,可直接建置網站神進化! 10.05.2025

Figma 在 2025 年發布會上的新功能和工具,旨在幫助設計師和團隊將設計流程從概念推進到實際成品。 文章介紹了 Figma Make,這是一個能將設計轉化為程式碼的工具; Figma Sites 則讓使用者能直接從 Figma 發布網頁。 此外,Grid 提供了更靈活的排版控制,Figma Draw 增強了向量編輯功能以實現更多元的視覺表達,而 Figma Buzz 則是一個專門用於創建品牌資產的空間。 這些更新共同強調了 Figma 成為...

Listen to the AI報報報 podcast in Replaio

Radio and podcasts in one app - free, with no sign-up. Install today and do not miss the launch

Get it on Google Play

Replaio is not a podcast publisher; show names, artwork and audio belong to their authors and are distributed through public RSS feeds.