先给结论:月活低于约 5,000 次记忆写入时,SaaS Memory 往往更便宜;超过 1 万次/月或需要私有化部署时,自建 Redis + Postgres(或国内 TencentDB)通常更省。数据库选型上:Redis 管会话与热记忆,Postgres(pgvector)管语义检索,TencentDB 适合要合规托管的国内团队。
最后更新于 2026 年 8 月 7 日。文中价格区间来自 2026 年主流云厂商与 Mem0、Zep 等公开定价页,实际账单因地区、折扣与用量浮动。
为什么「数据库月费」会误导 Agent Memory 预算
很多人把 Agent Memory 等同于「再买一个数据库」。但 Agent 的记忆至少包含三种不同成本:
- 写入成本——每次对话结束要不要摘要、要不要 embedding、要不要跨会话合并;这直接决定 API Token 与向量计算费。
- 存储成本——热数据放 Redis、温数据放 Postgres、冷归档放对象存储;单层 All-in-One 往往最贵。
- 召回成本——每次用户提问要查几次库、要不要 rerank、延迟要求是否 <100ms;高频召回让 Redis 账单超过 Postgres。
因此更准确的公式是:
月度 Memory 总成本 = 写入(模型 + embedding)+ 存储(DB + 备份)+ 召回(查询 QPS × 延迟档位)+ 运维人力
SaaS 厂商(如 Mem0、Zep、LangMem Cloud)把后三项打包成席位或 MAU 价;自建则每一项都要自己填表——规模小时 SaaS 省运维,规模大时自建省边际成本。
Agent Memory 怎么分类(What)
在对比 Redis、Postgres、TencentDB 之前,先对齐「记忆分层」——否则你会用向量库存会话 ID,或用 Redis 硬扛全文检索。
| 层级 | 典型内容 | 生命周期 | 首选存储 |
|---|---|---|---|
| L1 工作记忆 | 当前会话上下文、工具调用中间态、短期偏好 | 分钟~小时 | Redis / 进程内缓存 |
| L2 情节记忆 | 用户历史对话摘要、任务完成记录、偏好标签 | 天~月 | Postgres JSONB / 文档库 |
| L3 语义记忆 | 知识片段 embedding、RAG 文档块、跨用户可共享事实 | 长期 | Postgres pgvector / 专用向量库 |
非对称结论: 对多数 coding agent 与客服 bot,L2 情节记忆才是成本大头——因为写入伴随 LLM 摘要,而不是向量库本身贵。
核心对比:自建 Memory vs SaaS Memory(2026 月费锚点)
下表按「个人 side project / 小团队内测 / 生产 1 万 MAU」三档估算技术层月费(不含模型 API,含基础监控与备份)。货币:美元区间,人民币团队可在 TencentDB 行对照。
| 方案 | Side project | 小团队内测 | ~1 万 MAU | 运维负担 |
|---|---|---|---|---|
| Mem0 / Zep 等 SaaS | $0–29 | $49–99 | $199–499+ | 低(厂商管 SLA) |
| 自建 Redis + Postgres(云 VM) | $25–45 | $60–120 | $150–280 | 中(你要管补丁与备份) |
| TencentDB Redis + PostgreSQL | ¥300–600 | ¥800–1,500 | ¥2,000–4,500 | 低~中(托管补丁,合规国内) |
| 纯 Redis(All-in) | $15–30 | $40–80 | 内存膨胀快,不推荐生产 All-in | 中 |
交叉点经验值:当月记忆写入 < 5,000 次且团队无专职 SRE,SaaS 综合成本(含人力)更低;当写入 > 3 万/月或数据不能出境,自建或 TencentDB 更划算。
Redis vs Postgres vs TencentDB:谁更适合 AI Memory?
| 引擎 | 擅长 | AI Memory 典型用法 | 主要风险 |
|---|---|---|---|
| Redis | 亚毫秒 KV、TTL、Pub/Sub | L1 会话状态、速率限制、热记忆缓存、短期 user profile | 全内存成本高;持久化配置不当会丢记忆 |
| Postgres + pgvector | ACID、复杂查询、向量 + 关系混合 | L2 情节表 + L3 向量同库;审计与多租户隔离 | 向量规模大时需调 HNSW 参数与分片 |
| TencentDB(Redis/PostgreSQL) | 国内合规托管、自动备份、监控告警 | 面向大陆用户的 Agent 产品;替代自建 VM 上的数据库 | 比自建 VM 贵 15–30%;跨境访问延迟 |
推荐组合(而非单选):
- Redis(L1)+ Postgres pgvector(L2+L3)——最常见、文档多、Claude Code / LangChain 示例丰富。
- TencentDB Redis + TencentDB PostgreSQL——国内上线、等保与备案场景;应用层逻辑与上一组合相同。
- 仅 SaaS Memory——两周内要 demo、无人管数据库;后期可导出迁移到 Postgres。
场景怎么选(决策矩阵)
| 如果你是… | 推荐方案 | 原因 |
|---|---|---|
| 个人开发者验证 Agent 想法 | SaaS Memory 免费档 → 再迁自建 | 零运维,快速验证写入/召回逻辑 |
| 国内 toB Agent,数据不出境 | TencentDB + 自建应用层 | 托管合规,避免自己扛 DBA 7×24 |
| 高频 coding agent(每小时数十次工具调用) | Redis L1 + Postgres L2 | 热状态走 Redis,摘要落库可审计 |
| 知识库型 RAG Agent | Postgres pgvector 或专用向量库 | 向量规模 > 100 万条时调优 Postgres 或分流 Qdrant |
| 已有 SRE 的 10+ 人团队 | 自建 K8s 上的 Redis + Postgres | 边际成本最低,可统一 observability |
推荐组合(Stack)
组合 A — 最快 MVP(2 周)
- Mem0 或 Zep Cloud 托管情节 + 语义记忆
- 应用侧仅对接 API;会话状态仍放 Redis(Upstash 免费档)
- 月技术锚点:$0–49
组合 B — 可迁移的自建(推荐多数团队)
- Redis:会话与 24h 热记忆(TTL 自动过期)
- Postgres:用户表、对话摘要、pgvector 向量
- 夜间批任务:压缩 L2 → L3,控制 embedding 成本
- 月技术锚点:$60–150(小团队)
组合 C — 国内生产
- TencentDB Redis 2GB + TencentDB PostgreSQL 标准版
- 对象存储 COS 存原始对话归档(冷数据)
- 应用部署在同级地域 VPC,避免跨区流量
- 月技术锚点:¥1,200–2,500
常见误区
- 把所有记忆都 embedding——摘要文本走 L2 即可,不必条条量化;embedding 是隐形大项。
- 只用 Redis 当「永久记忆」——重启/淘汰策略会导致用户觉得 Agent「失忆」。
- 忽视召回 QPS——每次用户消息查 10 次向量库,比存 10 万条还贵。
- SaaS 按席位买,却一个 Key 全团队共用——审计与限流会失控,合规风险上升。
- Postgres 不配连接池——Agent 并发工具调用会打满连接,表现为「记忆时灵时不灵」。
- 国内用户用海外 SaaS Memory——延迟与数据出境双重问题,TencentDB 往往更省心。
落地步骤(7 步 Action Plan)
- 画出三层记忆表——列出 L1/L2/L3 各存什么、保留多久、谁可读。
- 估算月写入量——对话数 × 平均每轮是否触发摘要/embedding。
- 选交叉点——写入 <5k 先 SaaS;>3 万或要私有化则自建/TencentDB。
- 定存储组合——默认 Redis + Postgres;国内生产换 TencentDB 同构。
- 设召回预算——单次用户消息最多几次 DB/向量查询,写进代码常量。
- 跑 14 天实测——用真实对话灌数据,看存储增长与 P95 延迟。
- 准备导出格式——即使用 SaaS,也要能导出 JSON/Parquet 迁到 Postgres,避免厂商锁定。
FAQ
自建 Agent Memory 最低需要多少预算?
技术层可压到 $25–40/月:一台小 VM + 托管 Redis 免费档 + Postgres 单实例。但若计入每周 2–4 小时运维,小规模下往往不如 $29 SaaS 档划算。
Redis 能单独做 AI Memory 吗?
只适合 L1 工作记忆与短期缓存。长期情节与语义检索需要 Postgres 或向量库;否则内存成本和数据丢失风险都会上升。
Postgres pgvector 够用到多大?
百万级向量、维度 1536 以内,调优 HNSW 后多数 Agent 产品够用。再往上考虑专用向量库或分片,但 90% 团队等不到那一天。
TencentDB 比自建 VM 上的 Postgres 贵多少?
通常贵 15–30%,但含自动备份、监控、补丁与高可用切换。对没有 DBA 的国内团队,综合成本常更低。
SaaS Memory 数据能迁回自建吗?
多数厂商支持 API 导出用户与记忆块。迁移路径:导出 → 写入 Postgres L2 表 → 对需要语义检索的块重跑 embedding 进 pgvector。
总结
自建 Agent Memory 和 SaaS Memory 哪个更便宜,取决于 月写入量、召回频率与运维人力,而不是 Redis 和 Postgres 的标价。2026 年的务实路径是:MVP 用 SaaS,产品验证后用 Redis + Postgres 自建,国内合规生产换 TencentDB 同构托管。
上线前用一个问题自检:如果下个月记忆写入翻倍,哪一项账单先爆? 是 embedding、Redis 内存还是 SaaS 席位——答案会告诉你该留在 SaaS 还是迁到自建。
算例:30 人团队的 coding agent 一个月要花多少?
假设 30 名开发者每天使用类 Claude Code 的 Agent,每人每月 40 轮对话,其中 30% 的轮次触发情节摘要(L2)并写入 embedding(L3)。则每月约 360 次摘要写入 与 约 50 万 embedding Token。
- SaaS 路径:Mem0 Pro 档约 $49 + embedding API 约 ¥60–100 → 合计约 ¥450–550/月,几乎零运维。
- 自建路径:小 VM ¥170 + 托管 Redis ¥70 + Postgres ¥180 + embedding ¥90 + 约 3 小时运维 → 现金约 ¥510–650/月,若计入工程时薪则更高。
在这一量级,SaaS 的总拥有成本仍常更低。交叉点通常出现在 日活 Agent 用户 300+ 或 月记忆写入 1 万次以上——此时 Postgres 存储与 SaaS 席位费涨得比「每周抽一小时运维」更快。
Memory 上线后必须盯的四个指标
无论选 Redis、Postgres 还是 TencentDB,都应在用户抱怨 Agent「健忘」之前接上监控:
- write_latency_p95——摘要 + embedding 管线延迟;尖峰往往先于账单异常出现。
- recall_qps_per_session——若产品未改而 QPS 攀升,多半是 Agent 检索写成了循环调用。
- memory_bytes_per_user——无上限的 L2 JSON 比向量表膨胀更快。
- saas_export_age_days——用 SaaS 时,每季度做一次导出并恢复到 Postgres 的演练。
在远程 Mac 构建节点上跑 Agent 的团队,常把 Redis 与 Agent 网关放在同一 VPC,让 L1 召回保持在 5ms 以内,Postgres 仍放区域级实例。
延伸阅读
在稳定的 Cloud Mac 节点上开发 Agent
本地调试 Agent Memory 时,M4 统一内存适合同时跑 embedding 服务、向量检索与 Xcode 工程。独享节点按月订阅,避免为试跑记忆方案一次性买高配 Mac。