屏幕录制(Screen Recording)
用于 AI「看得见」——截图读屏、OCR、视觉模型理解当前屏幕内容。
- 打开 系统设置(System Settings)
- 进入 隐私与安全性 → 屏幕录制(Privacy & Security → Screen Recording)
- 打开 小绘 右侧开关;若列表中没有,点击
+添加应用程序中的小绘 - 如果开关已开启但仍无法读屏,关闭再重新打开,并重启小绘
Getting Started
从下载已签名安装包到对接 Codex / 内置 dsh,5 分钟跑通第一个任务。
从下载到交给小绘干活,5 分钟内完成。每一步的详细说明见下方各章节。
macOS 安装包
5 天免费试用
屏幕录制 · 辅助功能
麦克风,一次配好
Codex 登录
或 dsh 填 Key
"读一下这份需求
文档并总结"
读屏 · 规划 · 执行
结果播报给你
按平台选择 Apple 芯片 / Intel 芯片(macOS 14+) 或 Windows x64 安装包。详见下载安装 →
依次开启 屏幕录制、辅助功能、麦克风 三项权限并重启小绘。详见权限配置 →
Companion Tab 选 Codex(需先在 Codex 桌面端登录)或 DeepSeek Harness(内置 dsh,在 Harness 界面填 Provider / API Key)。详见对接说明 →
说一句「读一下这份需求文档并总结」,小绘自动读屏、规划、执行,并把结果播报给你。
Apple Silicon 用户下载 小绘_0.1.7rc3_aarch64.dmg;Intel 芯片用户下载 小绘_0.1.7rc3_x64.dmg(需 macOS 14 Sonoma 或更高版本);Windows 用户下载 HuiAgent_0.1.7rc3_x64-setup.exe(x64)。
双击 dmg,把 小绘 图标拖入 应用程序 文件夹。
当前安装包已签名,一般可直接双击打开。若系统仍提示无法验证开发者,请在访达中 右键 → 打开,或在「系统设置 → 隐私与安全性 → 安全性」中点击「仍要打开」。
打开后右下角出现 Companion 浮层,系统托盘出现图标。首次启动会自动部署本地边缘模型(约 1.1GB)、本地视觉模型(约 3.1GB)与本地语音模型(约 230MB),完成后即可使用。
小绘需要读取屏幕、控制键鼠、使用麦克风。首次使用请按顺序开启以下三项权限,并在授权后重新启动小绘。
用于 AI「看得见」——截图读屏、OCR、视觉模型理解当前屏幕内容。
+ 添加应用程序中的小绘用于 AI「做得动」——移动鼠标、点击、滚轮、按键、轨迹回放等键鼠控制。
用于语音通话模式——按住说话(PTT)下发任务,本地离线识别。
💡 提示:如需「执行中按 Esc 立即终止任务」,也依赖辅助功能权限。所有权限在「系统设置 → 隐私与安全性」中可随时关闭。
打开小绘后,在 Companion 浮层顶部 Tab 切换大脑:Codex 或 DeepSeek Harness(内置 dsh)。无需在外部 IDE 手工配置任何服务,读屏与键鼠能力由安装包内置。
在 Codex 桌面端完成账号登录(小绘复用当前登录态,不会修改你的 ~/.codex/config.toml)。
Companion 选择 Codex,小绘通过 Codex App Server 创建任务,聊天与回复同步到 Codex UI,最终结果也显示在小绘气泡中。
Companion 选择 DeepSeek Harness,应用自动启动内嵌 dsh Web UI(个人工作台)。
在 Harness 界面选择 Provider(如 DeepSeek)并填入 API Key 与模型地址,保存即可。
工作台支持会搜、会教、会讲解;UI 插件按前台应用自动挂载,Companion 语音 / 文字任务与 Harness 协同执行。
工作台就绪后,在 Companion 按住 PTT 或输入文字,例如「读一下这份需求文档并总结」。小绘自动读屏、规划、键鼠操作,并把结果播报给你。
请先在 Codex 桌面端完成登录,再回到小绘 Companion 选择 Codex Tab。小绘复用 Codex 当前登录态,无需在小绘内重复填 Key。
Companion 选择 DeepSeek Harness 后,内嵌工作台会自动打开。在 Harness 设置中选择 Provider(如 DeepSeek),填入 API Key 与 Base URL 即可,支持任意 OpenAI 兼容接口。
当前发布包已签名;若仍出现此提示,在访达中右键小绘 → 打开,选择「打开」确认一次即可。或在「系统设置 → 隐私与安全性」底部点击「仍要打开」。
授权后需完全退出并重新打开小绘。若仍无效,把对应权限开关先关闭再打开,再次重启。macOS 对权限变更缓存较严格。
首次启动会自动部署三个本地模型:边缘模型 Qwen2.5-1.5B-Instruct(约 1.1GB,用于读屏判断与文档大纲)、视觉模型 Qwen3-VL-4B(约 3.1GB,用于看懂屏幕画面、边缘视觉决策)和语音模型 SenseVoice(约 230MB,用于离线识别)。均在安装包内,首次启动自动部署,不联网、不上传。
推荐安装系统 OCR 引擎以提升读屏文本识别:brew install tesseract tesseract-lang。不安装时自动回退其它识别路径。
Intel 版安装包要求 macOS 14(Sonoma)或更高版本。Apple 芯片版支持 macOS 12 及以上。可在左上角 → 关于本机 查看系统版本;不确定芯片类型时,在「关于本机 → 更多信息」中查看「芯片」或「处理器」。
官方支持 macOS(需屏幕录制 / 辅助功能 / 麦克风权限)与 Windows x64(下载 HuiAgent_0.1.7rc3_x64-setup.exe 安装)。