继Transformer架构引发开发热潮后,AI领域迎来新的技术范式。TypeSafe AI近日推出Jev框架,该框架由OpenAI资深工程师、InstructGPT及RLHF研究共同作者Diogo Almeida创建。与传统大语言模型不同,Jev不生成自然语言,而是输出带有概率和置信度评分的结构化数据,旨在供软件直接执行快速决策。

TypeSafe表示,在结构化决策任务中,Jev能提供与前沿大模型相当的智能水平,但运行速度提升40至200倍,且成本大幅降低。目前,开发者已在AI智能体加速、游戏控制等多个场景验证了其价值。

基础设施与企业级应用

Cloudflare已将Jev集成至其AI平台,用于处理AI应用中的快速结构化决策。通过Cloudflare的模型目录,开发者可在智能体架构中利用Jev进行请求路由、工具选择等关键路径决策,避免传统大模型在多轮调用中产生的延迟累积。

Vercel则将其作为编码智能体fx的安全审查员。内部基准测试显示,相较于GPT-5.6 Luna,Jev在P95延迟下快5至18倍,并能提供更准确的安全分类。Vercel随后通过AI Gateway发布Jev,支持护栏、路由等类型化决策场景。

优化智能体工作流与评估

在智能体上下文管理方面,开发者Tamara Tran推出了fast-jev-compaction插件。该系统利用Jev对长篇编码对话进行压缩,通过评分机制移除不必要的工具调用和结果,保留关键信息,避免了传统摘要可能导致的文件路径或命令丢失问题。

Niaz Morshed开发的Jev Capability Resolver (JCR) 将Jev用作智能体能力路由层。JCR通过分层树结构搜索操作,仅返回最终动作所需文档。基准测试显示,在使用Opus 5和GPT-5.6-Sol时,JCR分别将平均智能体上下文减少85%和23%,总成本降低67%和16%。

类似地,开发者Daniel San构建的Claude Code模块利用Jev筛选相关技能,仅将选中技能的说明注入上下文,有效减少上下文膨胀,让主模型专注于任务执行。

在评估环节,LangChain研究人员将Jev用作AI智能体评估器。在对天气智能体的500次重复决策测试中,Jev与人工判断完全一致,分数方差比其他模型低92至913倍,平均延迟仅为0.44秒,单次评估成本0.00035美元。

实时控制与复杂场景模拟

Jev在实时交互环境中表现出显著优势。Browser Use推出的Jev Ultrafast浏览器智能体,通过将页面元素转换为索引表,由Jev在单次请求中选择点击、输入等操作。在Google Flights演示中,基于Jev的版本将中位任务时间从9.45秒降至7.09秒,浏览器协议调用从1,092次锐减至101次。

在游戏与模拟领域,Faadil Shaik构建的TypeSafe Mario利用Jev控制原版《超级马里奥兄弟》。系统读取模拟器遥测数据并转换为结构化JSON,Jev据此选择移动、跳跃等指令,实现了无需视觉管道的实时控制循环。

JevBall项目则模拟了一场由22个Jev实例独立控制的3D足球比赛。球员根据持球状态以不同频率(0.30秒至1.2秒)做出传球、射门等决策,平均延迟366毫秒,每比赛分钟成本约0.01美元。

此外,Jev Autopilot无人机模拟器展示了其在三维空间导航的能力。Jev接收高度、速度及障碍物等紧凑态势报告,单次请求即可输出油门、偏航等六个控制决策,响应时间约200毫秒。

大规模数据分类

DAIR.AI联合创始人Elvis Saravia利用Jev重新整理了约2,300篇AI研究论文的标签。相较于此前使用的DeepSeek V4 Flash,Jev在83秒内以0.14美元的成本完成了全量运行,识别出579个高置信度的主题变更,经人工审查后全部采纳。这一案例展示了常规生成模型与Jev快速结构化分类相结合的混合工作流潜力。

【星途科讯 图文丨赵晶 首发于ZAKER科技,转载请注明出处】