Andrew Ng发布OpenWorker 本地化AI助理实现交付而非聊天

1 阅读3分钟开源

背景

在生成式AI逐渐从聊天向实际产出迁移的浪潮中,Andrew Ng宣布推出OpenWorker——一款完全本地化的桌面AI同事。项目采用MIT许可,目标是让用户摆脱“聊完再动手”的模式,直接得到可交付的工作成果,如报告、Slack回复、日程更新等。

核心特性

  • 交付优先:用户先定义期望的产出(如一份完整的市场分析),系统会拆解任务、调用本地工具并在关键步骤前请求确认。
  • 多模型兼容:内置30+经挑选的工具调用模型,覆盖OpenAI(GPT‑5.6、GPT‑5.5)、Anthropic、Google Gemini等;同时支持完全本地的Ollama模型,无需云钥匙。
  • 风险分层:所有写入、执行、外部调用均经过四类风险(read、write_local、exec、external)以及五种权限模式的严格审查,确保安全可控。

技术实现

  • 桌面壳层:采用Tauri 2 + React 18 构建原生窗口,标识为 com.openworker.desktop,负责启动并监控后端 Python 服务器。
  • 本地代理服务器:基于 Python 3.10+、FastAPI 与 uvicorn,默认监听 127.0.0.1:8765,每轮最多 12 次模型‑工具交互。
  • 能力与连接层:提供文件、Git、ripgrep 搜索、Shell、Todo 等本地工具,同时可接入云端集成服务。
  • 模型路由层:使用 Andrew Ng 自研的 aisuite 库,实现对 OpenAI‑兼容、Open‑weight(Together AI、Fireworks)以及完全本地(Ollama)模型的统一调度。

隐私与安全

OpenWorker 将所有模型调用直接从本机发送至配置的提供商,密钥、对话和工具令牌始终保留在本地。唯一的云组件是可选的 OAuth Broker,用于一键连接外部服务,采用 Auth0 的 PKCE 流程,令牌同样不落地云端。风险引擎通过显式的提示注入防御,将工具输出视为不可信数据,避免 Prompt‑Injection。

市场意义

相比传统的聊天型AI,OpenWorker 把“思考‑执行‑交付”闭环搬到用户机器上,降低了数据泄露风险,也让企业可以在合规环境下直接部署高级 AI 助手。对个人用户而言,省去手动复制、整理的中间环节,显著提升生产力。随着本地大模型生态的成熟,类似的本地‑优先 AI 助手有望成为下一代工作流的标准组件。

“AI 的价值不在于聊天,而在于帮助人们完成真实任务。”——OpenWorker 项目团队

本文是对第三方新闻源的主观解读。消息可能出现过时、不准确、歧义或错误的地方,仅供参考使用。点击此处查看消息源。