boundary_id 查询参数,以及——在 BYOK 模式下——一个请求头。
Memory Router 处于内测阶段。如果您控制台的 Integrations 下尚未出现 Memory Router 卡片,请联系 support@memorylake.ai 申请开通。
第 1 步:获取密钥和 Boundary
- 登录控制台,创建一个 MemoryLake API Key(以
sk-开头)。 - 打开 Integrations → Memory Router API,创建一个 Boundary(记忆范围)——它把您的会话绑定到指定的工作空间、项目和 Actor。复制它的 id。
请将 MemoryLake 密钥保存在环境变量中,例如
MEMORYLAKE_API_KEY。密钥管理详见身份验证。不带 boundary_id 的请求仍然可用,但会以纯透传方式运行,记忆功能关闭。第 2 步:选择模式并替换 base URL
两种模式使用相同的端点——区别在于您发送哪些密钥:
完整对比见部署模式。
MemoryLake 托管——一个密钥
无需模型厂商账号。GPT、Claude 和 Qwen 系列模型均已内置;按原生模型名称调用任意模型即可。BYOK——使用您自己的模型厂商密钥
保留您现有的模型厂商账号。您的模型厂商密钥放在该厂商的原生鉴权头中(OpenAI 用Authorization: Bearer,Anthropic 用 x-api-key);MemoryLake 密钥则放在 x-memorylake-api-key 头中。
Anthropic SDK
使用 Anthropic SDK 时,将 base URL 设为https://app.memorylake.ai/anthropic——SDK 会自行追加 /v1/messages。
第 3 步:照常调用
像今天一样发送请求。附上boundary_id 后,相关记忆会自动召回并注入提示词,新记忆则异步提取并存储——响应绝不会被延迟。
TypeScript
X-Trace-ID 和控制台 Logs 页面,即可确认调用确实经过了 Router——参见可观测性。
较新的 OpenAI 推理模型(
gpt-5 系列、o1/o3/o4)在 Chat Completions 上要求使用 max_completion_tokens 而非 max_tokens。请让参数保持模型厂商官方格式——Router 会原样透传。后续步骤
部署模式
BYOK 与托管模式的完整对比,以及支持的模型厂商。
可观测性
追踪请求并理解错误约定。