代理
什么是代理?
代理是 AI 驱动的助手,可以代替您思考、行动和通信。与简单的聊天机器人不同,Neotask 代理是能够推理问题、执行任务和跨多个平台交互的自主实体。
代理的关键特征:
- 身份: 每个代理都有独特的名称、表情符号和个性,使其与其他代理区分开来。
- 工作区: 每个代理在自己的工作区内运行,文件、会话和上下文保持分离。
- 技能: 代理可以配备扩展其能力的模块化技能(参见技能)。
- 频道: 代理连接到 Slack、Discord 和邮件等通信平台以发送和接收消息(参见频道)。
- 独立性: 多个代理可以独立处理不同任务,或作为团队协作处理复杂工作流。
按套餐的代理容量
| 套餐 | 并发代理数 |
|---|---|
| Free | 仅主聊天代理;自定义代理创建被锁定 |
| Individual | 无限代理,拥有完整平台访问权限 |
| Business | 无限代理,另加公司运营与员工席位 |
| Enterprise | 无限代理,支持大规模多公司编排 |
在 Free 套餐上,主要支持的代理界面是交互式聊天、看板和编码工作流,均在 Free 配额内:首批 10 条消息/事件,之后每个用户本地日历日 5 条消息/事件。Free 用户可以连接应用和提供商密钥,但不能添加自定义代理或运行自主的公司代理。在所有付费套餐上,代理数量不设上限:Individual 让个人获得完整平台,Business 和 Enterprise 则增加公司运营和大规模并行编排,全部通过平台的团队编排引擎协调。详见计费与套餐了解使用方式。
创建代理
要创建新代理:
- 在控制面板中导航到代理。
- 点击创建代理。
- 提供以下信息:
- 名称: 代理的描述性名称(如 "支持机器人"、"DevOps 运行器")。
- 工作区: 选择现有工作区或创建新工作区。工作区决定代理存储文件和维护状态的位置。
- 表情符号: 选择一个表情符号以在控制面板中直观识别代理。
代理模板
Neotask 提供预配置的模板帮助您快速入门。每个模板都带有针对特定用例定制的推荐技能、模型设置和系统提示:
| 模板 | 描述 |
|---|---|
| 助手 | 用于日常任务、问答和生产力的通用助手 |
| 开发者 | 代码生成、调试、仓库管理和 CI/CD 工作流 |
| 研究员 | 深度研究、摘要和跨网信息收集 |
| 社交媒体 | 跨社交平台的内容创建、调度和互动 |
| 数据分析师 | 数据处理、可视化和报告 |
| 家庭自动化 | 智能家居设备控制、日程和监控 |
| 语音助手 | 语音转文本和文本转语音的对话工作流 |
| 导师 | 教育内容传递、测验和自适应学习 |
| 活动经理 | 营销活动规划、执行和分析 |
您可以在创建后自定义任何模板,也可以从空白代理开始。
代理配置
模型覆盖
默认情况下,代理使用 Neotask 设置中配置的系统级模型。您可以按代理覆盖此设置以分配特定的 AI 模型。
- 打开代理的设置标签。
- 在模型下,从下拉菜单中选择提供商和模型。
- 如果设置为系统默认,代理将遵循全局配置的模型。
当某些代理需要更强大的推理能力(如使用 Claude 4 Opus 进行架构设计任务)而其他代理可以使用更轻量的模型来降低成本(如使用 GPT-4.1 Nano 进行格式化)时,这很有用。
支出限额
通过设置每个代理的每日支出上限来控制成本。
- 导航到代理的设置标签。
- 在支出限额下,输入以美元为单位的每日最高成本。
- 当代理达到限额时,它将在当天剩余时间内停止发出 API 调用。
- 支出限额在 UTC 午夜重置。
自动执行确保没有单个代理会产生意外成本,这在 Enterprise 上运行数百个代理或代理按计划自主运行时尤为重要。
安全模式
安全模式在隔离的执行沙箱中运行代理。启用后:
- 文件系统访问限制在代理的工作区目录内。
- 网络请求限制在明确允许的域名。
- Shell 命令在受限环境中执行。
- 代理无法影响其他代理或系统级资源。
安全模式建议用于运行不受信任代码、与外部 API 交互或在最少监督下运行的代理。
代理会话
每个代理维护跟踪完整交互历史的对话会话。
会话类型
| 类型 | 行为 |
|---|---|
| 主会话 | 持久会话,跨交互延续。代理记住先前的上下文,可以引用早期消息。 |
| 隔离会话 | 每次创建新会话。不保留先前上下文。适用于无状态任务或当您希望代理从零开始时。 |
聊天历史
每个会话记录带有明确标记消息角色的完整聊天历史:
- 用户: 您发送的消息或从已连接频道接收的消息。
- 助手: 代理生成的响应。
- 系统: 系统级指令、提示或配置消息。
- 工具: 技能和工具执行返回的结果。
思维模式
启用思维模式可查看 AI 在生成响应前的内部推理过程。这有助于:
- 调试意外的代理行为。
- 理解代理如何得出决策。
- 审计复杂的多步推理链。
当思维模式激活时,代理的推理步骤会显示在每个响应上方的可折叠部分中。
附件
代理可以在会话中处理附件:
- 图片: 截图、照片、图表。代理可以分析和描述视觉内容。
- 文件: 文档、电子表格、PDF。代理可以阅读、总结和提取数据。
- 代码: 源文件和代码片段。代理可以审查、编辑和执行代码。
代理工具
代理配备了按类别组织的一组内置工具。这些工具始终可用,无需安装。
文件系统
| 工具 | 描述 |
|---|---|
| 读取 | 从代理工作区读取文件内容 |
| 写入 | 在代理工作区中创建或覆盖文件 |
| 编辑 | 使用查找和替换对现有文件进行定向编辑 |
执行
| 工具 | 描述 |
|---|---|
| Shell 命令 | 在代理环境中执行 shell 命令(bash、zsh 等) |
| 进程管理 | 启动、停止和监控正在运行的进程 |
| 子代理 | 生成子代理来处理子任务,实现并行和委托工作流 |
Web
| 工具 | 描述 |
|---|---|
| 浏览器自动化 | 控制无头浏览器以导航页面、填写表单、点击元素和捕获截图 |
| HTTP 请求 | 向 API 和 Web 服务发出 HTTP/HTTPS 请求,完全控制方法、头部和正文 |
调度
| 工具 | 描述 |
|---|---|
| Cron 任务 | 使用 cron 表达式调度循环任务(如每周一上午 9 点运行报告) |
| Webhooks | 注册 webhook 端点,当外部服务调用时触发代理操作 |
代理模型
Neotask 支持多个 AI 提供商和模型。您可以将任何支持的模型分配给任何代理。
支持的提供商和模型
Anthropic
| 模型 | 最适合 |
|---|---|
| Claude 4 Sonnet | 编码、分析和对话的平衡表现 |
| Claude 4 Opus | 复杂架构和分析的最深推理能力 |
| Claude 3.5 Haiku | 摘要和分类等快速轻量任务 |
OpenAI
| 模型 | 最适合 |
|---|---|
| GPT-5.1 | 复杂编码和生成任务 |
| GPT-4.1 | 具有强大指令遵循能力的通用任务 |
| GPT-4.1 Nano | 格式化和样板代码等超快轻量任务 |
| 模型 | 最适合 |
|---|---|
| Gemini 3 Pro | 复杂分析和长上下文推理 |
| Gemini 3 Flash | 具有大上下文窗口的快速研究和测试 |
| Gemini 2.5 Flash Lite | 高性价比的数据提取和简单处理 |
DeepSeek
| 模型 | 最适合 |
|---|---|
| DeepSeek V3.2 | 代码审查、文档和样板代码生成 |
OpenRouter
| 模型 | 最适合 |
|---|---|
| 多模型路由 | 基于任务类型和预算的自动模型选择 |
智能任务路由
当代理配置为使用智能路由时,Neotask 根据复杂度和类型自动为每个任务选择最佳模型。以下路由表显示默认分配:
| 任务类型 | 模型 | 层级 |
|---|---|---|
| 架构设计 | Claude Sonnet 4 | 重型 |
| 复杂编码 | GPT-5.1 | 重型 |
| 复杂分析 | Gemini 3 Pro | 重型 |
| 标准编码 | Claude Haiku 4.5 | 中型 |
| 代码审查 | DeepSeek V3.2 | 中型 |
| 测试 | Gemini 3 Flash | 中型 |
| 研究 | Gemini 3 Flash(100 万上下文) | 中型 |
| 文档 | DeepSeek V3.2 | 中型 |
| 数据提取 | Gemini 2.5 Flash Lite | 轻型 |
| 格式化 | GPT-4.1 Nano | 轻型 |
| 摘要 | Claude Haiku 3.5 | 轻型 |
| 简单任务 | GPT-4.1 Nano | 轻型 |
| 样板代码 | DeepSeek V3.2 | 轻型 |
层级定义:
- 重型: 需要深度推理、大上下文或高精度的任务。使用最强大(也最昂贵)的模型。
- 中型: 需要可靠性能但可由中端模型处理的任务。成本和能力的良好平衡。
- 轻型: 优先考虑速度和成本效率的常规任务。使用最快和最实惠的模型。
智能路由通过自动将正确的模型匹配到正确的任务来优化您的使用成本。这对于可能同时运行数百个代理的 Enterprise 套餐尤为有价值。