Minis:真正的随身Agent

2026年7月16日

64

903

Minis:真正的随身Agent

在移动办公场景日益丰富的今天,我们通常依赖于手机通信工具来调用远程或云端的AI Agent完成各种任务。这种方式虽然便捷,但始终存在一个根本性的局限:我们无法真正掌控设备端的能力,总要依赖网络连接和远程服务器的响应速度。Minis的出现正在改变这一现状。作为一款真正意义上的手机端独立Agent,Minis让用户无需借助任何外部设备或云端服务,就能在手机上完成复杂的人工智能任务。

内置Alpine Linux环境:移动端的完整开发栈

Minis的全称是OpenMinis,目前支持iOS和Android双平台。在Android设备上,Minis几乎可以实现对手机的完全操控;在iOS平台上则受到系统权限的一定限制。更值得关注的是,Minis对各种模型端点提供了极高的兼容性。无论是标准API接口、OAuth认证还是各类编程平台的模型服务,用户都可以灵活配置和使用。Anthropic和OpenAI的协议同样得到了良好的兼容,这为用户选择最合适的AI服务提供了极大的自由度。

视觉识别与文件管理:细节体验的极致优化

Minis最大的技术亮点在于内置了完整的Alpine Linux环境。这一设计使得Minis不仅仅是一个对话界面,而是一个真正可以运行代码、管理依赖、执行脚本的完整开发环境。具体来说,Minis对以下编程语言和工具提供了原生支持:Python环境完整可用且推荐使用uv进行依赖管理;Node.js提供了部分支持;Go和Rust语言可以正常运行;FFmpeg已内置并支持硬件加速。此外,Minis还内置了功能完整的浏览器组件,可以访问网站、填写表单、提取网页内容,甚至直接截取网页图像。这意味着在使用Minis时,用户几乎不会遇到那些在电脑上使用Agent时常见的"无法读取"或"无法解析"的问题——遇到读取困难的内容时,Minis会自动进行滚动截图以获取完整信息。

与其用通信工具去指挥远在天边的AI助手,不如让手机本身就成为一个能力完备的智能终端。

“技术观察”
🦞

JimoClaw — 桌面 AI Agent 工作台

让 AI 处理本地资料、操控浏览器,最终交付可直接使用的文档、表格与 PPT,而不只是一段回答。

下载桌面版

记忆模块与扩展机制:持续进化的智能助手

在视觉识别能力方面,Minis充分利用了iOS平台原生Vision框架的优势。对于文本提取这类基础任务,Minis无需依赖任何OCR模型即可直接调用系统原生能力,效果便捷高效。当然,如果需要理解照片内容的语义信息,多模态模型仍然是必要的选择。在密钥管理方面,Minis采用了环境变量集中管理的方案,这遵循了安全最佳实践。好的AI模型通常会建议用户将密钥写入环境变量而非直接在对话中暴露。Minis还内置了Token用量统计功能,让用户可以直观了解各模型的使用消耗情况。

模型分组机制:Minis的核心设计哲学

Minis的记忆模块设计体现了对用户体验的深入思考。新版本引入了独立的Soul.md和Global.md两个文件,分别用于不同的记忆管理场景。用户可以在主菜单中直接访问这些记忆文件,而Global.md也可以作为Tools.md使用。更令人印象深刻的是Minis的记忆主动记录能力——当用户与AI进行深入交流时,Minis会主动记录关键信息,这种体验甚至优于很多第三方记忆模块。在扩展性方面,Minis支持通过URL、文件或让AI协助的方式安装Skill,并且最新版本已支持MCP(Model Context Protocol),这意味着除了iOS系统的权限限制外,用户几乎不会遇到功能瓶颈。文件输出方面,每个会话都拥有独立的文件系统命名空间,输出文件需要用户手动保存到个人文件目录,这增加了一个操作步骤但也提升了文件管理的灵活性。特别值得一提的是,Minis支持导出JSON和纯文本格式的会话记录——虽然对人类阅读不太友好,但这些记录可以被其他AI系统完美解析和复用。

🛡️

积墨 AI 安全隐患巡检系统

任务一键下达 · 隐患 AI 识别 · 整改全程留痕 · 报告一键生成。让安全巡检真正看得见、管得住、能闭环。

了解方案

如有侵权,请联系删除。

Related Articles

联系我们 试用咨询
小墨 AI