TypeSafe Jev:官方宣传逐条核对
TypeSafe Jev 上线时挂着三条说法——快得多、便宜得多、不会幻觉——之后写它的文章大多原样搬一遍,没人动手验。能跑的我们跑了,跑不了的拿公开报价核了。逐条结果在下面。产品本身看Jev AI 是什么,内部机制看它内部怎么工作。
独立站点,与 TypeSafe 无关,内容未经他们审阅。数字都是我们自己测的,条件写在旁边。
TypeSafe AI 是谁
公开信息比这场发布的声量少得多。能核实的:TypeSafe 做并且卖 Jev 决策模型,开着控制台 console.typesafe.ai,维护 MIT 许可的官方 Python 和 JavaScript 客户端,除自有端点外还通过 OpenRouter 和 Vercel AI Gateway 卖,并发布了那份四工作流 benchmark——写 TypeSafe Jev 的报道大半建立在它上面。System One 是他们的自造词。
谁在经营、总部在哪、融了多少钱,我们不会说:各家说法连名字拼写都对不上,而一个整篇都在讲「我们会去核」的站没资格猜。
他们为什么不再做一个大模型,而是做 Jev
按 TypeSafe 自己的材料,论证是:生产系统让语言模型干的活大部分不是写作,而是分类、打分、判断——可选答案在发请求前就定死了。交给生成式模型,等于为没人看的推理过程付钱,再把结果解析回那个字段。
价目表是佐证不是装饰:TypeSafe Jev 输出按零计费,只有模型真的不生成才撑得住。
论证绕开了准确率,而 TypeSafe 自己公布的数字是:四个工作流上专用模型没赢过通用模型。交易是更快更便宜,划不划算取决于答错一次的代价。
宣称一:「快 40 到 200 倍」
TypeSafe Jev 给的数是 70 到 500 毫秒,小字比范围更要紧:那是服务端处理时间,不含网络。倍数是跟一个正在生成完整回复的语言模型比——只是比的是你看不见的那一段。
我们录到的,20 次调用全部成功:
| 测量项 | 端到端往返 |
|---|---|
| 最快一次 | 309 ms |
| 中位数 | 423 ms |
| 第 90 百分位 | 1041 ms |
| 最慢一次 | 1077 ms |
测试条件:2026-09-20,从中国大陆发起,经 OpenRouter 中转而非直连 TypeSafe,请求体是客服分流场景——一道选择题、一道打分题、一道是非题装在一个请求里。一天内在一处打 20 次是小样本。
结论:成立,但比较的对象要改。服务端那一段确实在他们给的区间里;端到端、隔着半个地球又过一道中转,中位数翻了一倍多,尾部摸到整整一秒。你体验不到 200 倍,体验到的是判断在页面跳转的时间里回来——请求路径上够快了,那才是重点。
宣称二:「便宜 444 倍」
每百万输入 token 收 $0.042、输出免费,这是 TypeSafe Jev 公布的价,算术没争议,有争议的是比较对象。444 倍比的是前沿模型——你用来写作和推理的那一类,没人拿它们分工单。该比的是为这类活准备的小而便宜的模型。
一次 TypeSafe Jev 调用,1000 个输入 token 加 10 个输出 token:
| 模型 | 单次成本 | 相对 Jev |
|---|---|---|
| Jev | $0.000042 | 基准 |
| GPT-5.6 Luna | $0.000212 | 5.0x |
| Claude Haiku 4.5 | $0.001050 | 25x |
价格核对于 2026-09-20。
结论:数字是真的,比错了对象。真实区间是 5 到 25 倍,不是 444 倍。25 倍足以改变一条预算线,但它跟发布页那条是两回事,在小量级上又约等于零:一个月十万次分类,TypeSafe Jev 大概 $4.20,最便宜的替代品大概 $21,切换的工时先把差价吃掉了。到不了那个量,选它是为了类型化输出和延迟,不是价格。算式在价格与获取方式。
宣称三:「不会幻觉」
真的,而且几乎总被读错——读错的往往正是赞许地引用它的人。
精确地说:模型不会返回你给定集合之外的答案。没有编造的类别,也没有坏掉的格式。
它不意味着答案是对的:被逼着从你的选项里挑,模型就挑,哪怕一个都不合适。TypeSafe 那份发票结果 61.8% 就是例证:每一次答错都是许可集合里一个格式完好的答案。
结论:说法准确,框法误导。「不会幻觉」读起来像「可以信任」,两者毫无关系。把 TypeSafe Jev 当成语言模型不靠谱的解药,是拿结构保证当准确率保证卖。这条保证管住了什么,它内部怎么工作算全了。
我们没能验证的部分
关于 TypeSafe Jev,四件我们没能定下来的事。
直连的延迟。上面每个数字都过了 OpenRouter。TypeSafe 自己的端点可能更快;没测,就不估。
百分比底下的那份 benchmark。我们拿到的是结果,不是题目、提示词和评分。TypeSafe 披露过:参考答案由两个前沿模型的答案平均生成,全程没有人类标注——那让每个分数量的都是「有多一致」而不是「有多对」。
一把我们自己的 key。控制台不需要邀请就能注册,这点确认了;但我们没真开一把 key 打线上请求,「注册完立刻能用」就没法替你担保。
压力下的表现。限流、持续吞吐、按周而不是按分钟算的可用性。20 次调用说明不了。
常见问题
TypeSafe AI 是什么公司?
做并且卖 Jev 决策模型的公司,自己卖也通过网关卖。除了产品,公开记录很薄,我们宁可留白也不转述核不实的。
TypeSafe Jev 免费吗?
不免费,但表只往一个方向转:每百万输入 token $0.042,输出免费。不想开账号就看本站的演练场,发的是真请求,每天有额度上限。
Jev 能上生产吗?
取决于一个错判的代价。支持:主流网关都在卖 TypeSafe Jev,我们那 20 次调用全部成功。反对:两个库还在 0.x,一个公开端点的路径里带着 alpha,准确率数字就是那个样子。
需要等候名单的邀请码吗?
不需要。console.typesafe.ai 用 Google 账号或邮箱验证码公开注册。TypeSafe 首页那个 Join Waitlist 按钮并不拦着控制台。几个网关也是通往 TypeSafe Jev 的公开路。
TypeSafe 靠什么赚钱?
靠输入 token,自己卖加通过网关转卖。能当事实讲的就这些:没找到企业版、量价和支持服务。