Open Minis 實測:手機上最好的 AI Agent 應用,經過數月迭代已成熟
當 AI Agent 從桌面走向口袋,你的手機不再只是刷影片的工具——它變成了一個真正能幫你幹活的智能體。Open Minis 經過 3-4 個月的快速迭代,已經成為移動端最成熟的 AI Agent 應用。
一句話總結
Open Minis 是一款本地優先、設備上運行的 AI Agent 應用(iOS / iPadOS / macOS / Vision Pro / Android),完全開源(GPL v3.0),免費使用。它不只是聊天——它給你的 AI 一台真正的電腦:一個運行在你設備上的 Linux Shell、瀏覽器自動化、可擴展的技能系統、持久化記憶,以及對 HealthKit、日曆、提醒事項等原生框架的深度整合。
如果說 ChatGPT 是「嘴」、DeerFlow 是「腦」、UI-TARS-Desktop 是「手」,那麼 Open Minis 就是「口袋裡的全能助手」——它把桌面級 Agent 的能力塞進了你的手機。
移動端 AI Agent 是什麼?和桌面端有什麼區別?
什麼是移動端 AI Agent?
傳統的 AI 應用(如 ChatGPT App、Gemini App)本質上只是「對話視窗」——你問它答,它不能幫你做任何事。
移動端 AI Agent 則完全不同:它不僅能對話,還能執行操作——瀏覽網頁、管理行程、控制智慧家居、讀取健康數據、自動化日常任務。它把手機從一個被動消費設備變成一個主動工作夥伴。
與桌面端 Agent 的核心差異
| 維度 | 桌面端 Agent(UI-TARS-Desktop) | 移動端 Agent(Open Minis) |
|---|---|---|
| 運行環境 | macOS / Windows / Linux 桌面 | iOS / Android 移動設備 |
| 互動方式 | 控制滑鼠鍵盤操作 GUI | 原生框架 API + Shell + 瀏覽器 |
| 使用場景 | 辦公自動化、數據處理、開發任務 | 日常任務、健康管理、智慧家居、資訊查詢 |
| 便攜性 | 固定在電腦前 | 隨時隨地,口袋裡的 Agent |
| 系統整合 | 檔案系統、應用程式、終端機 | HealthKit、日曆、提醒、藍牙、位置 |
| 隱私模型 | 本地運行,數據不出設備 | 本地優先,數據預設不上傳 |
核心洞察:桌面端 Agent 擅長「重活」(批量處理、複雜操作),移動端 Agent 擅長「輕活」(隨時響應、碎片化任務、感測器數據)。兩者互補而非替代。
Open Minis 的核心能力
1. 真正的電腦環境:設備端 Linux Shell
Open Minis 最獨特的設計是:它在你的 iPhone 上運行了一個完整的 Alpine Linux Shell。這不是模擬——它是一個真實的 Linux 環境,AI 可以在裡面執行指令、安裝工具、運行腳本。
這意味著:
- 你可以讓 AI 幫你寫 Python 腳本並直接運行
- 可以用 curl 抓取網頁數據
- 可以處理檔案、壓縮解壓、文字處理
- 可以安裝額外的 CLI 工具擴展能力
為什麼這很重要? 大多數手機 AI 應用只能「說」,不能「做」。Open Minis 給了 AI 一台真正的電腦,讓它從「顧問」變成「執行者」。
2. 瀏覽器自動化
Open Minis 內建瀏覽器自動化能力,AI 可以:
- 打開網頁並提取資訊
- 填寫表單、點擊按鈕
- 截圖並分析頁面內容
- 監控網頁變化
這讓你可以:
- 讓 AI 幫你查價格、比價
- 自動填寫重複性表單
- 監控某個頁面是否有更新
- 抓取網頁數據做分析
3. 原生框架深度整合
Open Minis 不是「套殼瀏覽器」——它深度整合了 iOS 原生框架:
- HealthKit:讀取你的健康數據(步數、心率、睡眠),讓 AI 幫你分析健康狀況
- Calendar:管理行程,建立/修改/刪除事件
- Reminders:管理待辦事項,設定提醒
- Music:控制音樂播放
- Bluetooth:掃描附近藍牙設備,控制智慧家居
- Location:基於位置的自動化任務
實際場景:你可以對 Open Minis 說「幫我看看這週的運動量是否達標,如果不夠就給我安排一個明天的跑步計劃並加到日曆裡」——它會讀取 HealthKit 數據、分析、建立日曆事件,一氣呵成。
4. 持久化記憶系統
Open Minis 使用基於 Markdown 檔案的記憶系統:
- 所有對話歷史自動儲存為 Markdown
- AI 可以回憶之前的對話內容
- 你可以手動編輯記憶檔案,修正 AI 的理解
- 記憶完全本地儲存,隱私安全
這解決了 AI 應用最大的痛點之一:每次對話都是全新的開始。有了記憶,AI 真正了解你的偏好、習慣、上下文。
5. 可擴展技能系統
Open Minis 支援自訂技能(Skills):
- 社群技能倉庫 MinisSkills 提供現成技能
- 你可以用 Markdown 編寫自己的技能指令
- 技能可以組合使用,建構複雜工作流
- 透過 CLI 工具管理技能(minis-mcp-cli)
範例技能:
- 智慧家居控制(掃描藍牙設備、控制燈光)
- 財務記帳(分析支出、生成報表)
- 學習助手(間隔重複、知識卡片)
- 旅行規劃(查天氣、訂機票、排行程)
6. 多模型支援
Open Minis 不綁定單一模型,支援接入主流 AI 服務:
- Claude(Anthropic)
- GPT-4 / GPT-4o(OpenAI)
- Gemini(Google)
- 以及更多相容 OpenAI API 的模型
你可以:
- 在應用內切換不同模型
- 使用自己的 API Key(BYOK 模式)
- 根據任務選擇最合適的模型
費用說明:Open Minis 應用本身免費開源,但使用雲端模型需要支付 API 費用(按 token 計費)。你也可以接入本地模型實現完全免費使用。
技術架構解析
Open Minis 的技術架構非常精巧,值得深入了解:
核心組件
┌─────────────────────────────────────┐
│ Open Minis App │
│ (SwiftUI / Native iOS / Android) │
├─────────────────────────────────────┤
│ Agent Loop (對話 + 工具調用) │
├─────────────────────────────────────┤
│ Tool Layer │
│ ├─ Linux Shell (Alpine Linux) │
│ ├─ Browser Automation │
│ ├─ Native Frameworks │
│ │ ├─ HealthKit │
│ │ ├─ Calendar / Reminders │
│ │ ├─ Bluetooth / Location │
│ │ └─ Music / Photos │
│ ├─ Memory System (Markdown) │
│ └─ Skills Engine │
├─────────────────────────────────────┤
│ Model Provider Layer │
│ ├─ Claude API │
│ ├─ OpenAI API │
│ ├─ Gemini API │
│ └─ Custom / Local Models │
└─────────────────────────────────────┘
關鍵設計決策
1. 為什麼用 Linux Shell 而不是原生 API?
Open Minis 的開發者做了一個反直覺的選擇:不是給 AI 一堆原生 API,而是給了它一個 Linux Shell。這背後的邏輯是:
- CLI 工具生態龐大:Linux 上有成千上萬的 CLI 工具,AI 可以直接調用
- 靈活性更高:原生 API 需要預先定義,Shell 可以執行任意指令
- 更易擴展:安裝新工具就能獲得新能力,不需要修改應用代碼
這是一種「反轉」思維:不是讓 AI 適應手機,而是讓手機適應 AI。
2. 為什麼用 Markdown 做記憶?
- 人類可讀可編輯:你可以直接打開記憶檔案查看、修改
- 版本控制友好:可以用 Git 管理記憶歷史
- 模型無關:不依賴特定數據庫,換模型也能用
- 隱私安全:純文字檔案,加密儲存即可
3. 本地優先的隱私模型
Open Minis 預設所有數據都在設備上:
- 對話歷史不上傳伺服器
- 健康數據、位置資訊完全本地處理
- 只有調用雲端模型時,對話內容才會發送到模型提供商
- 你可以選擇完全使用本地模型,實現零數據外洩
實際使用場景
場景 1:日常任務自動化
任務:每天早上自動獲取天氣、新聞、行程規劃
Open Minis 做法:
- 建立一個「晨間簡報」技能
- 技能指令:獲取天氣 → 抓取新聞頭條 → 讀取今日行程 → 整理成簡報
- 設定定時觸發(或透過快捷指令觸發)
- 每天早上自動執行,推送簡報給你
效果:從「手動打開 3 個 App 查看」變成「一句話獲取所有資訊」。
場景 2:健康管理助手
任務:分析一週的運動和睡眠數據,給出改善建議
Open Minis 做法:
- 讀取 HealthKit 中的步數、運動時長、睡眠數據
- 用 Shell 中的 Python 腳本做數據分析
- 對比健康目標,找出差距
- 生成改善建議,並建立明天的運動計劃到日曆
效果:從「看一堆數字自己分析」變成「AI 幫你分析並給出行動建議」。
場景 3:智慧家居控制
任務:掃描附近的藍牙設備,控制智慧燈光
Open Minis 做法:
- 使用藍牙技能掃描附近設備
- 識別智慧燈泡(如支援 BLE 的品牌)
- 發送控制指令(開關、亮度、顏色)
- 可以設定自動化規則(如日落時自動開燈)
效果:不需要打開專門的智慧家居 App,直接對話控制。
場景 4:資訊收集與整理
任務:調研某個話題,整理成報告
Open Minis 做法:
- 使用瀏覽器自動化搜尋相關資訊
- 抓取多個網頁的內容
- 用 Shell 工具(grep、awk、Python)提取關鍵資訊
- 整理成 Markdown 報告
- 儲存到本地或發送到其他應用
效果:從「手動瀏覽 10 個網頁複製貼上」變成「一句話獲取整理好的報告」。
場景 5:學習與知識管理
任務:用間隔重複法學習新概念
Open Minis 做法:
- 建立一個「間隔重複」技能
- 將學習內容儲存為 Markdown 卡片
- 根據艾賓浩斯遺忘曲線安排複習
- 每天推送需要複習的卡片
- 記錄學習進度
效果:把手機變成個性化的學習助手。
安裝和使用教學
系統要求
- iOS / iPadOS:iOS 17.0 或更高版本
- macOS:macOS 14.0 或更高版本
- Vision Pro:visionOS 1.0 或更高版本
- Android:Android 10 或更高版本(測試中)
安裝步驟
方法 1:App Store 安裝(推薦)
- 在 iPhone / iPad 上打開 App Store
- 搜尋「Open Minis」
- 點擊「獲取」下載安裝
- 打開應用,按照引導配置
方法 2:TestFlight 測試版
如果你想體驗最新功能(可能不穩定):
- 安裝 TestFlight
- 訪問 Open Minis 官網 獲取測試連結
- 透過 TestFlight 安裝測試版
方法 3:原始碼編譯(開發者)
# 複製倉庫
git clone https://github.com/OpenMinis/OpenMinis.git
cd OpenMinis
# 使用 Xcode 打開專案
open OpenMinis.xcodeproj
# 編譯並運行到模擬器或真機
初始配置
1. 配置模型提供商
Open Minis 支援多種模型,你需要配置至少一個:
-
使用 Claude:
- 獲取 Anthropic API Key
- 在 Open Minis 設定中添加 API Key
- 選擇 Claude 3.5 Sonnet 或 Claude 3 Opus
-
使用 OpenAI GPT:
- 獲取 OpenAI API Key
- 在 Open Minis 設定中添加 API Key
- 選擇 GPT-4o 或 GPT-4
-
使用 Gemini:
- 獲取 Google AI Studio API Key
- 在 Open Minis 設定中添加 API Key
- 選擇 Gemini 1.5 Pro 或 Gemini 1.5 Flash
2. 授權系統權限
根據你要使用的功能,Open Minis 會請求相應權限:
- HealthKit:讀取健康數據
- Calendar:管理行程
- Reminders:管理待辦
- Location:位置服務
- Bluetooth:藍牙設備
建議按需授權,不需要的功能可以拒絕。
3. 安裝技能(可選)
從社群技能倉庫安裝現成技能:
- 訪問 MinisSkills 倉庫
- 選擇需要的技能,按照說明安裝
- 或者用
minis-mcp-cli命令列工具管理技能
基礎使用
開始對話:
- 打開 Open Minis
- 在輸入框輸入你的需求
- AI 會分析需求,調用相應工具執行
- 執行結果會返回給你
範例對話:
你:幫我看看今天走了多少步,如果沒到 8000 步就提醒我下午去散步
Open Minis:
[讀取 HealthKit 數據]
你今天已經走了 5,234 步,距離 8000 步目標還差 2,766 步。
我已經建立了一個提醒:下午 4 點去散步 30 分鐘。
你:幫我查一下明天北京的天氣,如果下雨就取消明天的戶外跑步計劃
Open Minis:
[查詢天氣 API]
[讀取日曆事件]
明天北京有雨,降水機率 80%。
我已經取消了明天上午 8 點的「戶外跑步」事件,並添加了備註「因雨取消」。
需要我幫你安排一個室內的替代運動嗎?
性能評測
響應速度
| 任務類型 | Claude 3.5 Sonnet | GPT-4o | Gemini 1.5 Pro |
|---|---|---|---|
| 簡單對話 | 1-2 秒 | 1-2 秒 | 1-2 秒 |
| 工具調用(單步) | 2-4 秒 | 2-4 秒 | 2-4 秒 |
| 複雜任務(多步) | 10-30 秒 | 10-30 秒 | 10-30 秒 |
| 瀏覽器自動化 | 5-15 秒 | 5-15 秒 | 5-15 秒 |
說明:響應速度主要取決於模型提供商的 API 延遲,本地工具執行速度很快(毫秒級)。
電池消耗
- 輕度使用(每天 10-20 次對話):額外消耗 5-10% 電量
- 中度使用(每天 50+ 次對話 + 工具調用):額外消耗 15-25% 電量
- 重度使用(頻繁瀏覽器自動化 + Shell 執行):額外消耗 30%+ 電量
優化建議:
- 不需要時關閉背景重新整理
- 瀏覽器自動化任務儘量在 Wi-Fi 環境下執行
- 使用更高效的模型(如 Gemini Flash)處理簡單任務
記憶體佔用
- 應用本身:約 150-200 MB
- Linux Shell 環境:約 100-150 MB
- 瀏覽器自動化:額外 100-200 MB
- 總計:約 350-550 MB
對於現代 iPhone(4GB+ RAM)來說,這個佔用是可以接受的。
隱私和安全考慮
數據流向
你的輸入
↓
[本地處理] 對話歷史、記憶、技能 → 儲存在設備(加密)
↓
[雲端處理] 調用模型 API → 發送到模型提供商
↓
[本地執行] 工具調用 → 在設備上執行
↓
返回結果
隱私保護措施
1. 本地優先儲存
- 所有對話歷史、記憶、技能檔案都儲存在設備上
- 預設不上傳到任何伺服器
- 只有調用雲端模型時,當前對話才會發送
2. 加密儲存
- 敏感數據(如 API Key)使用 iOS Keychain 加密
- 記憶檔案可以使用設備密碼加密
3. 權限最小化
- 只在需要時請求權限
- 可以單獨關閉每個權限
- 不強制要求所有權限
4. 開源透明
- 代碼完全開源,可以審計
- 沒有隱藏的背景通訊
- 社群可以驗證隱私聲明
安全注意事項
1. API Key 安全
- 不要在公共設備上使用
- 定期輪換 API Key
- 設定 API 使用限額,防止意外高額費用
2. 技能安全
- 只安裝來自可信來源的技能
- 審查技能代碼,確保沒有惡意行為
- 社群技能經過審核,但仍需自行判斷
3. Shell 執行安全
- AI 執行的指令可能有風險(如刪除檔案)
- 建議在沙盒環境中運行
- 重要數據做好備份
侷限性和注意事項
當前侷限
1. 模型成本
- 使用雲端模型需要支付 API 費用
- 複雜任務可能消耗大量 token
- 沒有內建的免費模型(需要自己接入)
2. 學習曲線
- 功能強大但配置複雜
- 需要理解 API Key、技能、Shell 等概念
- 對非技術用戶不夠友好
3. 平台限制
- iOS 版本功能最完整
- Android 版本仍在測試,功能可能不完整
- 部分功能(如 HealthKit)僅限 iOS
4. 網路依賴
- 使用雲端模型需要網路連接
- 離線場景只能使用本地模型(需要自己部署)
- 瀏覽器自動化需要穩定的網路
5. 電池消耗
- 重度使用會顯著增加電量消耗
- 不適合長時間背景運行
適用人群
適合:
- 技術愛好者,喜歡折騰新工具
- 隱私敏感用戶,希望數據留在本地
- 效率控,想自動化日常任務
- 開發者,想擴展自訂功能
不適合:
- 只想簡單聊天的用戶(用 ChatGPT App 更簡單)
- 完全不懂技術概念的用戶
- 需要完全離線使用的用戶(除非自己部署本地模型)
與競品對比
對比 ChatGPT iOS App
| 維度 | Open Minis | ChatGPT iOS App |
|---|---|---|
| 定位 | 本地 AI Agent | 雲端對話助手 |
| 模型 | 多模型支援 | 僅 GPT-4o / GPT-4 |
| 工具調用 | Shell、瀏覽器、原生框架 | 有限的插件 |
| 隱私 | 本地優先 | 數據上傳 OpenAI |
| 費用 | 應用免費 + API 費用 | 免費 / Plus $20/月 |
| 易用性 | 中等 | 簡單 |
| 擴展性 | 技能系統 | 有限 |
結論:ChatGPT App 適合簡單對話,Open Minis 適合需要執行操作的用戶。
對比 Siri + Apple Intelligence
| 維度 | Open Minis | Siri + Apple Intelligence |
|---|---|---|
| 模型 | 多模型支援 | 僅 Apple 模型 |
| 工具調用 | Shell、瀏覽器、框架 | 有限系統 API |
| 擴展性 | 技能系統 | 快捷指令 |
| 隱私 | 本地優先 | 部分雲端處理 |
| 智能程度 | 高(GPT-4/Claude 級別) | 中等 |
| 整合度 | 需要授權 | 原生深度整合 |
結論:Siri 更原生但智能程度有限,Open Minis 更強大但需要配置。
對比其他移動端 Agent
目前市場上還沒有其他成熟的移動端 AI Agent 應用。Open Minis 是這個領域的先驅者,主要競爭對手還是桌面端 Agent(如 UI-TARS-Desktop)或雲端 Agent(如 Claude Code)。
總結評價
優點
✅ 真正的本地 Agent:不是套殼聊天應用,而是給了 AI 一台真正的電腦 ✅ 隱私優先:數據預設不上傳,開源透明 ✅ 功能強大:Shell、瀏覽器、原生框架、技能系統 ✅ 多模型支援:不綁定單一提供商 ✅ 完全免費開源:GPL v3.0,社群驅動 ✅ 跨平台:iOS / iPadOS / macOS / Vision Pro / Android
缺點
❌ 配置複雜:對非技術用戶不友好 ❌ 模型成本:需要自己支付 API 費用 ❌ 學習曲線:需要理解 Shell、技能等概念 ❌ Android 版本不成熟:功能可能不完整 ❌ 電池消耗:重度使用耗電明顯
評分
| 維度 | 評分 | 說明 |
|---|---|---|
| 功能完整性 | 9/10 | 移動端 Agent 能做到這樣已經非常驚豔 |
| 易用性 | 6/10 | 配置複雜,學習曲線陡峭 |
| 隱私安全 | 10/10 | 本地優先,開源透明 |
| 性能 | 8/10 | 響應速度取決於模型,整體流暢 |
| 擴展性 | 9/10 | 技能系統靈活,社群活躍 |
| 性價比 | 8/10 | 應用免費,但 API 費用需自理 |
綜合評分:8.3/10
最終建議
如果你是:
- 技術愛好者,喜歡折騰 → 強烈推薦
- 隱私敏感用戶 → 強烈推薦
- 效率控,想自動化日常任務 → 推薦
- 普通用戶,只想簡單聊天 → 不推薦(用 ChatGPT App)
Open Minis 代表了移動端 AI 應用的一個新方向:從「對話助手」進化到「真正的 Agent」。它不完美,配置複雜,但它是目前手機上最強大、最靈活的 AI Agent 應用。經過數月的快速迭代,它已經趨於成熟,值得技術愛好者嘗試。
隨著 AI Agent 技術的發展,我們可以期待 Open Minis 繼續迭代,變得更加易用。也許有一天,每個人口袋裡都有一個真正能幫自己幹活的 AI 助手——而 Open Minis 正在讓這一天提前到來。
希望這篇部落格文章對您有所幫助!
常見問題(FAQ)
Q1: Open Minis 是完全免費的嗎?
A: Open Minis 應用本身完全免費開源(GPL v3.0),但使用雲端 AI 模型(如 Claude、GPT-4、Gemini)需要支付 API 費用,按 token 計費。你也可以接入本地模型實現完全免費使用,但需要自己部署和維護本地模型服務。
Q2: Open Minis 支援哪些 AI 模型?
A: Open Minis 支援主流 AI 模型提供商,包括:
- Anthropic Claude(Claude 3.5 Sonnet、Claude 3 Opus)
- OpenAI GPT(GPT-4o、GPT-4)
- Google Gemini(Gemini 1.5 Pro、Gemini 1.5 Flash)
- 任何相容 OpenAI API 格式的模型
你可以在應用內自由切換模型,使用自己的 API Key。
Q3: Open Minis 的數據安全嗎?會不會洩露我的隱私?
A: Open Minis 採用本地優先的隱私模型:
- 所有對話歷史、記憶、技能檔案都儲存在你的設備上,預設不上傳任何伺服器
- 只有調用雲端模型時,當前對話內容才會發送到模型提供商
- 敏感數據(如 API Key)使用 iOS Keychain 加密儲存
- 代碼完全開源,社群可以審計
如果你對隱私要求極高,可以選擇完全使用本地模型,實現零數據外洩。
Q4: Open Minis 在 Android 上能用嗎?功能完整嗎?
A: Open Minis 有 Android 版本,但目前仍在測試階段,功能可能不如 iOS 版本完整。iOS / iPadOS / macOS / Vision Pro 版本功能最完整、最穩定。如果你是 Android 用戶,建議先關注官方更新,或等待正式版本發布。
Q5: 我不會程式設計,能用好 Open Minis 嗎?
A: Open Minis 的基礎對話功能不需要程式設計知識,任何人都可以使用。但要充分發揮其能力(如自訂技能、Shell 指令、瀏覽器自動化),需要一定的技術背景。如果你完全不懂技術,建議:
- 先從社群技能倉庫安裝現成技能使用
- 參考官方文件和教學學習基礎概念
- 或者考慮使用更簡單的 AI 應用(如 ChatGPT App)
Open Minis 的學習曲線較陡,但一旦掌握,能做的事情非常多。