Andrew Ng 发布 OpenWorker:一款注重结果而非对话的开源桌面 AI 智能体
Moonshot AI
Anthropic
OpenAI
Google/DeepMind
DeepSeek
MiniMax
Alibaba/Qwen
xAI
Mistral
Together AI
Fireworks AI
Ollama
安德鲁·吴(Andrew Ng)发布了 OpenWorker,一款开源 AI 智能体。它不进行对话,而是直接生成现成结果:格式化文档、包含事实数据的 Slack 回复、更新后的日历。该智能体将任务分解为步骤,处理本地文件和应用程序,并在重大操作前请求确认。该解决方案基于本地栈构建,使用 aisuite 库,支持 30 种模型,包括通过 Ollama 运行的本地模型。
吴恩达(Andrew Ng)发布了OpenWorker —— 一款开源的桌面AI代理,它交付的是完成的工作,而非进行对话。用户无需输入提示词,而是指定期望的结果:一份已完成的文档、包含精确数字的Slack回复、更新后的日历、整理好的收件箱。随后,代理会将任务拆解为多个步骤,处理本地文件和已连接的应用程序,并在执行任何重要操作前请求确认。其架构包含四个层级:基于Tauri 2与React 18的桌面外壳、运行于Python(FastAPI、uvicorn,端口127.0.0.1:8765)的本地代理服务器、能力与连接器层(本地工具、托管集成、MCP)以及基于aisuite库构建的模型路由器。OpenWorker不提供自有推理服务——用户需自行插入API密钥或运行本地环境。支持的模型列表包含30个选项:原生提供商(OpenAI、Anthropic、Google)、兼容OpenAI的模型(GLM、DeepSeek、Kimi、MiniMax、Qwen、Grok、Mistral)、通过Together AI和Fireworks提供的开放权重模型,以及通过Ollama运行的完全本地模型(无需密钥)。其关键特性是权限引擎,该引擎将每个操作按四个风险类别分类(读取、写入、命令执行、外部影响),并支持五种权限模式。在自主模式下,通知会发送到收件箱,会话暂停直至收到回复。安全策略规定,模型应将工具内容、日志、网页和传入消息视为不可信数据,而非指令。隐私通过本地处理得到保障:模型调用直接进行,连接器令牌和密钥保留在本地机器上,机密信息不会进入模型上下文。唯一的云组件是用于OAuth握手的可选代理(采用PKCE的Auth0),令牌直接发放至本地机器,不会存储在云端。该应用无需登录即可完全运行。源代码已在GitHub上以MIT许可证发布。
来源: MarkTechPost —
原文
