AI 信任层

你的 AI 已经上线生产。
你能证明它的回答值得信赖吗?

Vairify——AI 信任层。每一条响应都在用户看到之前,对照证据完成验证,并附上加密证明。只需更改一个 URL,无需改动任何代码。

无需信用卡·5 分钟部署·只需更改一个 URL

user: "Is it safe to release v2 tomorrow?"
assistant: "All 1,204 tests pass. Zero known regressions."
vairify: claim "1,204 tests pass" → detectverifyevidence
vairify: evidence: CI logs · 1,204/1,204 · SHA-256 ✓
VERIFIED & PASSEDtrust 0.94 · policy: ship allowed · proof 4f9a…c1
9检测引擎
6判定分类
1部署仅需一次 URL 变更
0数据不离开你的边界(自托管)
信任层 · 10 秒

不是在最后给出判定。
而是在用户看到之前完成转变。

区别在于「系统告诉你它可能错了」和「系统在任何人看到之前就修复了它」。每一条响应都会自动通过完整的信任流水线。

你的应用发送提示词——代码不变
任意 LLMOpenAI · Anthropic · Gemini · Ollama · 自托管
Vairify Edge——AI 信任层检测 → 修复 → 验证 → 策略 → 证据
用户只看到已验证且符合策略的响应 · 决策追踪
信任模式 · 一个开关

从「也许正确」到「策略强制执行」

按环境设定标准。Vairify 决定每条响应在送达前如何处理。

01OFF

透传——仅透明遥测。

02WARN

标记有风险的响应,附带探测注解后送达。

03BLOCK

高风险主张永远不会到达用户——返回策略违规提示。

04AUTO FIX · roadmap

在送达前修复响应。用户看到修正后的答案。

05MULTI-MODEL · roadmap

确定性低时在多个模型间取共识。

06HUMAN REVIEW · roadmap

关键领域的回答进入审批队列。

07AUDIT

每条送达的回答都附带完整决策追踪 + 证据。

VERIFIED RESPONSE MODE · roadmap

路线图(V2):任何内容在通过你的质量策略之前不会到达用户。今天 V1 负责检测、验证和拦截——修复功能随 V2 网关上线。

商业承诺

「打开一个模式,每条终端用户回答都会自动满足你的质量策略。无需盯看仪表盘,无需人工逐条审查。」

问题

LLM 不懂真相。
它们只懂概率

每一个自信的回答都只是统计学上的猜测。在生产环境中,一条捏造的主张可能到达客户、报告或监管机构——而等你发现时,损失已经发生。

Air Canada · 2024

聊天机器人编造了一项丧亲票价政策。法院裁定该航空公司必须兑现这条幻觉。公司辩称机器人「对自己的行为负责」——仲裁庭不予认可。

src: BC Civil Resolution Tribunal · src: CNBC
Deloitte · 2024

一个已投产的 AI 工具伪造了法律和财务引用。错误直到客户为有缺陷的输出付费后才暴露。损失:声誉 + 44 万澳元集体诉讼。

src: Reuters · src: ABC News
忽视的代价

一条幻觉究竟要付出多大代价

€35M欧盟 AI 法案不合规最高罚款
100%的输出责任在你——而非模型供应商
~4h手动将一条错误主张追溯回源头
0接受审计要求后出示证明所需秒数——使用 Vairify

你无法让模型无所不知,但你可以让它的输出可以被证明

为什么现有工具会失败

仪表盘告诉你模型失败了。
但它们无法阻止失败。

评测仪表盘

事后诸葛。LangSmith、Promptfoo、W&B 在事后报告评分——在一个运行时无人关注的仪表盘上。没有强制执行,没有证明。

护栏 / 过滤器

模式,不是真相。Lakera、Guardrails AI 扫描词语和越狱提示。一个语气自信但听起来干净的错误主张会原样通过。

模型供应商

没有保证。OpenAI、Anthropic、Google 不为事实正确性背书——他们的服务条款也明确如此。法律风险由你承担。

Vairify

运行时证据。拦截响应,验证主张,附加判定和加密证明——在用户看到之前。

产品 · 9 大引擎,实时端点

保护,而非功能。
证明,而非承诺。

如果你的 AI 明天开始胡说八道,Vairify 会在你的用户看到之前拦截。九大引擎、六种判定类别、加密证明——安心感内置其中。

01Hallucination Detection

7 信号检测器:模糊量词、虚假确定性、不可验证的主张、自我吹捧。

02Fake Certainty

标记「100%」「保证」「绝对可靠」——没有证据的精确。

03Theater Detection

识破伪装成事实的修辞表演。

04Governance Engine

按组织进行策略检查、爆炸半径、防火墙规则。

05Evidence Extraction

提取可验证的主张,并附上来自来源的支持证据。

06Blast Radius

衡量一条错误主张在你的技术栈中会造成多大的破坏。

07Trust Scoring

带治理权重的四维评分——按主张、模型、组织维度。

08Replay

精确重现任意历史判定。几分钟定位根因,而非几天。

09Sycophancy Detection

捕捉那些为讨好而非求真而生成的回答。

6 种判定类别

VERIFIED · PARTIALLY_VERIFIED · UNVERIFIED · HALLUCINATED · CONTRADICTED · PENDING——每种都附带置信度、证据链和证明哈希。

实时演示 · 立即体验

现在就测试一条主张

粘贴一句 LLM 可能生成的句子。Vairify 会对其分类——要么调用实时 API,要么在本地使用相同的检测模式。

verdict
运行一次检查,看看 Vairify 如何分类这条主张。
工作原理 · 4 个步骤

从提示词到证明,只需四步

01输入

你的应用通过 Vairify 的 OpenAI 兼容端点向 LLM 发送提示词。

02提取

Vairify 从响应中提取原子化操作性主张:事实、数字、日期、预测。

03验证

9 大引擎对照证据和策略为每条主张评分。确定性校验器检查数字和日期。

04判定

VERIFIED → CONTRADICTED,附置信度、证据链和 SHA-256 证明哈希。

你将获得

信任层为你赢得的仪表盘

不是「一份判定历史」——而是 AI 响应质量的总控中心。

Verified通过证据检查的响应
Flagged在边缘捕获的可疑响应
Blocked在边缘拦截的策略违规
Blocked在送达前拦截的高风险响应
Trust Score按主张、模型、组织维度——跟踪趋势
Requests每个组织受保护交互总数
Policy按规则、按环境的违规次数
Trust Score按主张、模型、组织维度——跟踪趋势
企业版与架构

真相基础设施,而不是又一个 SaaS 玩具

自托管优先

Docker 镜像、单一二进制、零出站数据(除你选择上报的验证外)。运行在你的防火墙之后。

Rust / Axum 核心

内存安全、异步、单一静态二进制。无运行时依赖,无供应链意外。

加密证明

每条判定都是一条锚定 SHA-256 的证据链。端到端可重放。天生具备审计就绪性。

API 密钥,而非会话

HMAC-SHA256 机器密钥。限速的认证路由。按组织的治理与信任评分。

SOC 2 进行中 · SSO/SAML 路线图中——我们对现状保持诚实。自托管今天就能填补这一空白。

API · 一个端点

兼容 OpenAI。零集成工作量。

# 把你的客户端指向 Vairify——这就是全部改动
curl http://localhost:8080/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{"model":"gpt-4o","messages":[{"role":"user","content":"Summarize our Q3 security posture"}]}'

# 响应会带回一个「probes」数组——即判定结果
"probes": ["detector": "hallucination::vague_quantifier", "status": "warn", "score": 0.3]
安全

我们对你的数据永不做什么

不用于训练

你的提示词和响应不会被用于训练任何东西。

无追踪

落地页零 Cookie。无行为指纹识别。

无数据外泄

自托管模式:验证在你的网络内部运行。遥测为可选开启。

无你无法控制的存储

证据和判定存放在你的数据库中。审计追踪归你所有。

定价 · 真实功能,拒绝噱头

5 分钟开始验证

Free Trial

试用评估

$0 / 14 天
  • 25,000 条受保护响应
  • 3 名团队成员
  • 主张验证
  • 证据导出
  • 治理策略
  • 验证重放
免费开始 →
Team

生产环境

$299 /月 · $2,990/年
  • 100,000 条受保护响应
  • 10 名团队成员
  • 包含 Free 版全部功能
  • 验证重放
  • 治理策略
  • 自托管
免费试用 →
Scale

高流量

$1,499 /月 · $14,990/年
  • 500,000 条受保护响应
  • 25 名团队成员
  • 包含 Team 版全部功能
  • 自定义治理
  • 优先支持
免费试用 →
Enterprise

定制方案

定制 / 按年
  • 无限次验证
  • SSO/SAML(路线图)
  • 专属实例
  • 合规包
  • 专业服务
联系销售 →

无需信用卡·支持自托管·随时取消

常见问题

诚实的问题,诚实的答案

LLM 响应中的原子化操作性主张——事实、数字、日期、预测、指令。每条主张都会获得六种判定之一,附带置信度和证据。我们不评判文风;我们评判可证明性。

仪表盘在事后打分,无法改变运行时。Vairify 位于请求路径上,随每条响应返回判定——外加一份可以展示给审计人员的加密证明。

把你的客户端指向 Vairify 端点(兼容 OpenAI)。这就是全部集成。大多数团队在 5 分钟内验证第一条主张。自托管:一个 Docker 容器。

自托管模式下不会——验证在你的边界内运行。云模式下,提示词和判定存储在你的租户数据库中,绝不用作训练数据。遥测为可选开启。

任何兼容 OpenAI 的端点:OpenAI、Anthropic、Gemini、Ollama、vLLM、自托管模型。代理不关心是谁生成的文本。

SOC 2 正在进行中。目前,自托管 + 加密证据链 + 重放已覆盖审计就绪缺口。我们对认证情况保持透明,而不是伪造徽章。

不能——任何做出这种承诺的人都在撒谎。检测基于模式 + 证据,并辅以确定性数值校验。我们大幅降低风险,并为通过验证的内容提供证明。这就是诚实的立场。

即将推出 · V2

Vairify AI Copilot 候补名单

面向 AI 安全的浏览器助手。在你粘贴敏感数据前获得即时警告,捕捉没有任何引用的回答,标记有风险的查询——直接在 ChatGPT、Claude、Gemini 和 DeepSeek 中使用。

Chrome · Edge · Firefox

只有在你需要时我们才会构建它。无垃圾邮件,无打扰。

最终行动号召

你的 AI 每秒都在提出主张。
你能证明其中多少?

无需信用卡·5 分钟部署·支持自托管