Skip to content

Noeta一直跑下去的 agent

一个 Python SDK。进程崩了能接着跑,等人审批等几天也不占资源,从一个脚本扩到多机集群,agent 代码一行不用改。

Noeta

几行代码跑起一个 agent ​

装好 noeta-sdk,设好 ANTHROPIC_API_KEY,agent 就能用内置的文件工具去看你的项目。

python
from noeta.sdk import Options, query
from noeta.sdk.providers import AnthropicProvider

result = query(
    Options(system_prompt="You are a concise coding assistant."),
    goal="What files are in this directory, and what does each one do?",
    provider=AnthropicProvider(),
    model="claude-sonnet-5",
)
print(result.answer())

返回的不只是答案:这次运行里每一次模型调用、工具调用和 token 用量都在里面。快速上手 →

整体结构 ​

你的代码query() · Clientworker 池
可选,任何 worker 都能接手任何任务
Noeta,跑在你自己的进程里主循环:每一步都这样走组装上下文模型决定执行工具重复,直到完成或需要等待插件:所有能力都走同一套公开接口文件与 shell网页MCP记忆沙箱模型适配器你的插件也这样接进来事件日志SQLite 或 Postgres每一步都追加状态靠重放得出追加重放模型 APIAnthropic兼容 OpenAI 的网关

agent 走的每一步都追加进事件日志,所以任何一个 worker 都能靠它把任务重建出来。agent 能做的一切——工具、MCP、记忆,连模型本身——都是插件。原理 →

天生可扩展 ​

一切都是插件内核本身不带任何能力。文件工具、网页、记忆、MCP、沙箱、模型适配器全是插件,走的是和你的插件同一套公开接口。
什么模型都能接Anthropic、任何兼容 OpenAI 的网关、OpenAI Responses API。换模型只改一行,agent 和它的历史记录都不变。
先审批,再动手有风险的工具调用会停下来等人批准。guard 可以在调用执行前拦下它;observer 只能旁观,干扰不了任务。

和其他方案比 ​

NoetaClaude Agent SDKLangGraphTemporal
是什么可持久运行的 agent 运行时(一个库)Claude 的 agent 循环库基于图的 agent 框架持久化工作流平台
谁决定下一步模型一步步决定模型决定你预先定义的图你写好的工作流代码
存下来的是什么每一个事件,状态由事件推出来对话记录图状态的检查点工作流历史
等人 / 等定时器内置,恰好唤醒一次恢复对话中断后由调用方恢复内置
横向扩展worker 池;多机共用 Postgres单进程自己想办法,或用托管平台Temporal 集群
模型任意,一行切换Claude任意—
要额外运维的服务没有,只有你的进程和数据库没有没有Temporal 服务端

agent 要长时间无人值守地跑,而且要能恢复、能审计、能扩容,就选 Noeta。完整对比 →

公开基准上的实测 ​

24/40
Terminal-Bench 2.1
40 题抽样 · 首轮成绩;三次取最好 33/40 · noeta-sdk 0.6.28,跑一次 · 公开榜单(全集)58.7%–83.8%
13/15
SWE-bench Verified
15 题子集 · 首轮 9/15,重跑了 4 个环境准备超时 · noeta-sdk 0.6.10,跑一次

只用公开 SDK 搭出来的 agent(noeta-agent 的 main,Claude Opus 4.8),在官方评测框架上跑出的成绩。每项都是在抽样上跑一次,不是全量榜单成绩,较高的数算上了重跑。方法和说明 →

接下来 ​

基于 Apache License 2.0 发布。