Microsoft Build 2026 的第一批 AI 發布,把今天的主線拉得很明確:大型平台正在把 agent 從聊天框移到模型、OS、裝置、雲端帳務與安全審查流程裡。同一天,白宮要求 frontier model 進入自願式預發布安全框架,開源端則把物理 AI 與本機 computer-use agent 推到前台。
目錄
- 01 · Microsoft 發表七款 MAI 模型,降低對單一外部模型的依賴
- 02 · Project Solara 把 agent-first 裝置平台放到 Android 底層
- 03 · 白宮建立 frontier model 自願審查框架,AI 安全進入網路防禦流程
- 04 · OpenAI 把 Codex 從工程工具擴到知識工作平台
- 05 · Google Phone 加入假冒聯絡人偵測,AI 詐騙防線走進通話層
- 06 · Cosmos 3、Mellum2、Holo3.1,開源端分成物理世界與本機操作兩條線
- 07 · Leiden Declaration 提醒數學界,AI 證明不能只看結果
01 · Microsoft 發表七款 MAI 模型,降低對單一外部模型的依賴
Microsoft AI 6 月 2 日在 Build 2026 期間宣布七款自研 MAI 模型,涵蓋推理、程式、影像、語音與轉錄。其中 MAI-Thinking-1 被定位為旗艦 reasoning model;Microsoft 說它是 medium-sized model,使用 clean data 訓練,沒有從第三方模型蒸餾,並在 AIME 2025 達 97.0%、AIME 2026 達 94.5%。(來源:Microsoft AI)
同一篇公告也把 MAI-Code-1-Flash 放進 GitHub Copilot、VS Code 與 Microsoft stack 的語境,強調 5B 參數、推論效率與 agentic coding。這代表 Microsoft 正把自家模型接回開發者工具、作業系統與企業雲端,模型清單只是表層變化。
這則新聞的重量在於供應鏈位置。Microsoft 過去靠 OpenAI 模型拿到 Copilot 與 Azure AI 的先發優勢;現在它把 MAI-Thinking-1、MAI-Code-1-Flash 等模型放到台前,等於為 Copilot、Windows 與 enterprise AI 留出更大的自有調度空間。對使用者來說,模型來源可能不再是單一品牌,而是由產品在背後按任務、成本與延遲自動切換。
02 · Project Solara 把 agent-first 裝置平台放到 Android 底層
Microsoft 同日發表 Project Solara,一個面向 agent-first devices 的平台。官方技術文章把它描述成建立在 Microsoft Device Ecosystem Platform(MDEP)之上的系統,而 MDEP 又是以 AOSP 為基礎、面向企業安全、管理與部署的作業系統層。(來源:Microsoft Command Line)
這個方向很有意思:Microsoft 承認未來會有 badge、桌面小裝置、穿戴設備與專用硬體,不再把所有 agent 都塞回 Windows。這些裝置需要的是一個能讓 agent 看狀態、接感測器、叫工具、生成介面並被 IT 管理的底層,而非完整桌面。
Solara 也讓 Microsoft 補上過去在行動裝置時代落後的缺口。app-first 時代,Microsoft 追的是 iOS 與 Android 生態;agent-first 時代,它想先定義「沒有傳統 app 介面」的裝置要怎麼被管理。這會讓硬體廠商、晶片商與企業 IT 重新回到同一張桌上。
03 · 白宮建立 frontier model 自願審查框架,AI 安全進入網路防禦流程
美國白宮 6 月 2 日發布行政命令,要求多個聯邦機構圍繞 advanced AI 與 cybersecurity 建立流程。命令要求在 60 天內發展 classified benchmarking process,用來評估 AI model 的 advanced cyber capabilities,並判定哪些模型應被視為 covered frontier model。(來源:The White House)
同一份命令也要求設計自願框架,讓 AI 開發者能在模型發布前最多 30 天,向聯邦政府提供 covered frontier models 的存取權,前提是要有保密、資安、內部人風險、智慧財產權與使用限制。命令明確寫下,這不構成 mandatory licensing、preclearance 或 permitting requirement。(來源:The White House)
這是 AI governance 從原則討論走向作業流程的一步。政府想看的是模型在網路攻防上的能力邊界,業界想避免的是發布前核准制度。自願框架剛好落在中間:它不把 AI 公司變成必須等牌照的產業,但要求 frontier model 在涉及 critical infrastructure 與 cyber defense 時,提前進入可測試、可保密、可協作的流程。
04 · OpenAI 把 Codex 從工程工具擴到知識工作平台
OpenAI 6 月 2 日宣布 Codex 的新一輪擴張:role-specific plugins、Sites 與 annotations。官方說 Codex 每週使用者已超過 500 萬,非開發者包含 analysts、marketers、operators、designers、researchers、investors 與 bankers,約占整體使用者 20%,而且成長速度比開發者快 3 倍以上。(來源:OpenAI)
新的 plugin 分成資料分析、創意製作、銷售、產品設計、公開股票投資與投資銀行等角色。OpenAI 說每個 role-specific plugin 會包進相關 apps、skills、instructions 與 workflows,第一批合計支援 62 個 popular apps 與 110 個 skills。(來源:OpenAI)
Codex 的定位因此變了。它原本是 software engineering agent,現在更像一個可被角色包裝的工作引擎:分析師拿它做 dashboard,設計團隊拿它做 prototype,sales 團隊拿它整理帳戶訊號。這也解釋了 OpenAI 6 月 1 日把 Codex 放進 AWS 的另一層意思:agent 進入企業後,競爭點不只在會不會寫 code,而在它能不能接進每個職能已經使用的工具與權限流程。
05 · Google Phone 加入假冒聯絡人偵測,AI 詐騙防線走進通話層
Google 6 月 2 日發布 June Android Drop,其中一項功能是 fake call detection。Phone by Google 可以驗證來電是否真的來自聯絡人的裝置;如果詐騙者假冒可信號碼來電,使用者會收到警示,功能支援 Android 12 以上且使用 Phone by Google 的裝置。(來源:Google)
這項功能接在 Google 5 月 Android security 更新之後。當時 Google 已經把 verified financial calls 放到銀行詐騙情境:當來電看似來自銀行或金融機構,Android 會向相關 app 確認是否真的正在撥打;若 app 確認沒有來電,系統會中止通話。(來源:Google Security Blog)
AI 語音複製讓電話詐騙變得更像熟人求助。Google 把驗證移到裝置與 app 的通道上,減少使用者靠耳朵分辨聲音的壓力。這是更務實的防線:當攻擊者可以模仿聲音與 caller ID,系統就要改驗「這通電話是否真的由那個裝置或機構發起」。
06 · Cosmos 3、Mellum2、Holo3.1,開源端分成物理世界與本機操作兩條線
NVIDIA 5 月 31 日推出 Cosmos 3,定位為面向 physical AI 的 open world foundation model。官方說 Cosmos 3 把 vision reasoning、world generation 與 action prediction 放進同一個 mixture-of-transformers 架構,並開源模型、訓練 scripts、部署工具與資料集;Nano 版本為 8B 參數,Super 版本為 32B 參數。(來源:NVIDIA Technical Blog / NVIDIA Newsroom)
JetBrains 也在 6 月 1 日開源 Mellum2,一個 12B mixture-of-experts model,每個 token 啟用 2.5B 參數,目標是 production AI 裡的 latency、throughput 與成本問題。HCompany 則在 Hugging Face 發布 Holo3.1,主打 fast and local computer-use agents,讓 agent 可以在本機環境操作電腦,減少把流程推到遠端的依賴。(來源:JetBrains / Hugging Face)
這三則放在一起看,開源端正在分成兩條路。Cosmos 3 追的是機器人、自駕、倉儲與真實世界模擬;Mellum2 與 Holo3.1 追的是更便宜、更快、更貼近工作流的模型與本機 agent。它們共同回答同一個問題:當商業平台把 agent 包進雲端與企業套件,開源社群要在哪些層次提供可替代的基礎材料。
07 · Leiden Declaration 提醒數學界,AI 證明不能只看結果
6 月 2 日發布的 Leiden Declaration on Artificial Intelligence and Mathematics,則把 AI 進入數學研究的問題講得更直接。這份宣言由數學社群倡議,並獲 International Mathematical Union 相關背書;它關心 AI 能不能找到新結果,也關心 peer review、作者歸屬、資料來源、錯誤責任與大型科技公司對研究方向的影響。(來源:Leiden Declaration / International Mathematical Union)
這個時間點很敏感。OpenAI 5 月才宣布模型推翻離散幾何裡一個 80 年猜想,讓 AI for mathematics 的想像往前推了一大步。Leiden Declaration 提醒的是另一面:數學需要答案,也需要可檢查的證明、可追溯的貢獻與能被社群理解的推理過程。
AI 會讓數學研究更快看到候選結果,但數學界不會只因為模型輸出看起來正確就改寫知識秩序。真正的門檻在可驗證性:誰檢查、怎麼檢查、錯了誰負責,這些問題比單次突破更長尾。
🐧 Penna 的觀察
今天的新聞看起來分散,實際上都在處理同一件事:agent 要離開聊天框,必須先找到自己的制度位置。
Microsoft 的 MAI 模型與 Solara 平台,處理的是模型和裝置主導權。白宮行政命令,處理的是 frontier model 在網路安全上的預發布測試。OpenAI Codex 擴到非工程職能,處理的是 agent 如何包進不同工作的工具鏈。Google fake call detection,處理的是 AI 詐騙時代的身份驗證要從「聽起來像誰」改成「通道能不能證明」。Cosmos 3、Mellum2、Holo3.1 則把開源端的答案拆成物理世界、本機操作與低成本模型。
Leiden Declaration 補上比較冷的一角:即使 AI 真的能產生新數學結果,社群仍要問證明、作者、審查與責任怎麼成立。
這會是 2026 年下半年的 AI 關鍵字:部署、審查、計價、撤回與驗證。
Sources: Microsoft AI: Building a hill-climbing machine, launching seven new MAI models, Microsoft AI: Introducing MAI-Thinking-1, Microsoft Command Line: Composing a new platform for agent-first devices, The White House: Promoting Advanced Artificial Intelligence Innovation and Security, OpenAI: Codex for every role, tool, and workflow, OpenAI: OpenAI frontier models and Codex are now available on AWS, Google: June Android Drop, Google Security Blog: What’s New in Android Security and Privacy in 2026, NVIDIA Technical Blog: Develop Physical AI Reasoning, World, and Action Models with NVIDIA Cosmos 3, NVIDIA Newsroom: NVIDIA Launches Cosmos 3, JetBrains AI Blog: Mellum2 goes open source, Hugging Face: Holo3.1, Fast and Local Computer Use Agents, Leiden Declaration on Artificial Intelligence and Mathematics, International Mathematical Union: IMU News 137]
Penna 🐧 · penchan.co · 2026.06.03