免费 AI 内容审核
用 Ollama Cloud 或自建模型做日常内容审计,不必为 Moderations 接口单独付 OpenAI 账单。
少付一笔 OpenAI Moderations 费用,保留你已有的客户端。 几分钟加上免费的 Ollama 内容审核。
用 Ollama Cloud 或自建模型做日常内容审计,不必为 Moderations 接口单独付 OpenAI 账单。
同一套 POST /v1/moderations。OpenAI SDK、sub2api、或任意 Moderations 客户端,改个地址就能用。
配置多个 Ollama Key,网关自动轮询;遇 401 / 403 / 429 / 配额会冷却坏 Key,流量继续走。
一个小服务搞定。Docker Compose、Kubernetes Helm,或本地几步启动,不用重写客户端,也不用上重型平台。
默认走 Ollama Cloud;想私有部署,指向本机 Ollama,数据留在你自己的网络里。
模型挂了或结果不可用时直接报错,绝不会凭空返回「全部通过」。
最对口的场景: sub2api 的内容审计(风控中心 · 内容审计)本来就支持 OpenAI 风格 Moderations 后端。 本服务就是那个后端 —— 界面继续用 sub2api,打分走免费的 Ollama。
/v1
填你自己的网关:
http://localhost:8000(本地)或
https://moderation.example.com(自建)——
不要再加尾部 /v1。
sub2api 会自己拼 /v1/moderations;多写一层路径会 404。
用 moderation-fast
(界面若偏好别名,也可用 omni-moderation-latest)。
填网关的 MODERATION_API_KEY,
不是 Ollama Cloud 密钥。
使用你在自己部署上配置的密钥。
timeout_ms 设为 30000
默认 3000 对云端模型延迟太短。
sub2api: github.com/Wei-Shaw/sub2api
主路径:pip install、Docker Compose 或 Helm。
Render 演示可选,可能休眠/冷启动 —— 别当主 CTA。
生产主路径。Chart 在 charts/ollama-moderation-gateway(v0.1.0)。先在集群外创建 Secret,再 helm upgrade --install。
把 .env.example 复制为 .env,填密钥,docker compose up --build。端口 8000。适合单机。
onrender.com 或许能试接口,但常会休眠/超时。优先本地或 Helm(示例域名 moderation.example.com)。
建议在 Chart 外创建 Secret —— 默认 secrets.create: false,此时必须提供 existingSecret。
镜像:ghcr.io/aaronyang0628/ollama-moderation-gateway:v0.1.0(GHCR;私有包可能需要 imagePullSecrets)。
代理相关环境变量默认为空;仅在集群需要出口代理时再设置(真实代理地址不要进公开仓库)。
Ingress 默认 nginx + cert-manager,主机名为占位符 moderation.example.com(请改成你自己的)。
kubectl create namespace moderation kubectl -n moderation create secret generic ollama-moderation-gateway \ --from-literal=OLLAMA_API_KEYS='key1,key2' \ --from-literal=MODERATION_API_KEYS='gw-key1,gw-key2' helm upgrade --install ollama-moderation-gateway ./charts/ollama-moderation-gateway \ -n moderation --create-namespace \ --set secrets.create=false \ --set secrets.existingSecret=ollama-moderation-gateway \ --set ingress.hosts[0].host=moderation.example.com \ --set ingress.tls[0].hosts[0]=moderation.example.com \ --set ingress.tls[0].secretName=moderation.example.com-tls
冒烟:curl https://moderation.example.com/health,
再带网关 Bearer Key POST /v1/moderations。
Chart 说明:
charts/ollama-moderation-gateway/README.md。
cp .env.example .env # 设置 MODERATION_API_KEY、OLLAMA_API_KEYS(Cloud)以及 APP_ENV=production docker compose up --build
三步搞定,不讲架构课。
OpenAI SDK、sub2api、curl —— 凡是会请求 /v1/moderations 的都行。
Key 自动轮换。你选云端或自建。moderation-fast 等别名会映射到对应 Ollama 模型。
OpenAI 风格的 flagged / 类别 / 分数,直接接进现有风控流程。
| 你传入 | Ollama 实际跑 | 说明 |
|---|---|---|
moderation-fast |
gpt-oss:20b |
默认推荐 |
moderation-standard |
gemma4:31b |
更重一点 |
moderation-accurate |
gpt-oss:120b |
最大;自托管需要充足硬件 |
omni-moderation-latest |
gpt-oss:20b |
仅名称兼容 — 非 OpenAI 质量 |
优先 pip install ollama-moderation-gateway。文档密钥只是本地冒烟占位。生产请看 部署(Helm)。
pip install ollama-moderation-gateway export APP_ENV=development export MODERATION_API_KEY=local-moderation-key # Cloud: export OLLAMA_API_KEYS=... # 自建: export OLLAMA_BASE_URL=http://127.0.0.1:11434 ollama-moderation-gateway
源码开发:pip install -e ".[dev]",再
uvicorn app.main:app --host 0.0.0.0 --port 8000。
curl http://localhost:8000/v1/moderations \
-H 'Authorization: Bearer local-moderation-key' \
-H 'Content-Type: application/json' \
-d '{
"model": "moderation-fast",
"input": "待审核文本"
}'
主路径:上面的本地 curl。可选演示
onrender.com
可能休眠/冷启动。生产示例:
moderation.example.com —— 见 部署。
本服务的质量不等同于 OpenAI 官方审核模型
(omni-moderation-latest)。
它用通用 Ollama 对话模型做免费 / 自托管内容审计 —— 省钱、可控,但和专用安全分类器不是一回事。
上线前请用自己的流量试一试。
pip install、Compose 或 Helm —— 再把 sub2api / SDK 指过来。