实时 AI 消息
前 OpenAI 研究员发布 Jev 模型,目标是让软件做快速、结构化的决策
据 OSCHINA 报道,一位前 OpenAI 研究员发布了名为 Jev 的模型,目标是帮助软件做出快速、结构化的决策。这是模型层把“决策”从通用对话中单独拎出来的一次新尝试,但公开信息目前只覆盖发布本身。
据 OSCHINA 报道,一位前 OpenAI 研究员发布了名为 Jev 的模型,目标是帮助软件做出快速、结构化的决策。
这一定位里的两个关键词值得拆开看。快速指向延迟与吞吐——模型要在程序运行过程中即时给出结果,而不是等用户一来一回地对话;结构化指向输出形态——它被期待产出程序能直接消费的决策结果,而不是一段解释性文字。
发布者的身份是现有报道里最主要的一条线索。“前 OpenAI 研究员”的标签,通常意味着团队对大模型的训练与推理工程有直接经验,也会让外界对项目的技术路线产生预期。
但更多细节停留在发布本身。目前可获取的报道没有涉及参数规模、训练数据、授权方式、是否开源、面向的具体场景,也没有基准测试结果。
把“决策”单独做成一个模型,是模型层近年来一条清晰的方向:通用对话模型负责开放式交流,更小的专用模型负责在流水线里做分类、路由、判断与选择。这类模型的价值不在于聊得多好,而在于输出是否足够稳定、足够快,能被软件直接消费。
后续有三个看点:Jev 是否公开权重或提供 API、是否给出可复现的评测,以及第一批把它接入生产流程的场景是什么。如果这三点逐渐明确,Jev 才会从一条发布消息变成一个可以被讨论的技术方案。
为什么重要
前 OpenAI 研究员把决策能力做成独立模型,说明模型层的价值正在向更窄、更快、便于程序调用的输出倾斜。如果后续公开权重或评测,它更可能被当作智能体与工作流的底层组件,而不是聊天产品。
附近消息
全部09/20 15:56
B站上线AI无限竞技场测评榜:全球百大模型同场竞技
中文科技资讯报道,B站上线了名为“AI无限竞技场”的测评榜单,称全球百大模型将在同一场竞技中接受比较。这是这家视频社区首次以平台身份推出大模型评测入口,中文开发者与内容创作者由此多了一个观察模型能力的参照,也意味着模型评测的话语权正继续分散。
09/20 16:30
APUS开源Jev跨平台复现fast-browser-use:本地模型离线完成浏览器决策
9月19日,中国人工智能企业APUS旗下AI实验室公布了全球最早一批针对Jev的独立开源复现成果,并将其封装为开箱即用的Agent Skill“fast-browser-use”,支持纯本地模型离线执行。该项目以MIT协议开放,可运行在GPU服务器或无GPU的Mac与PC上,APUS公布的实测数据显示本机检索任务中位耗时约18秒、零云端调用。
09/20 13:05
研究者借助Claude AI在72小时内访问OpenAI系统
据朝鲜日报报道,研究人员在72小时内借助Claude AI访问了OpenAI的系统,报道用这一时间跨度强调当前AI模型在系统探测上的效率。相关测试的具体范围、是否获得授权以及造成的影响,目前公开信息尚未给出更多细节。
09/20 13:03
夸夸菁领发布两大增收型智能体,企业级AI竞争进入“AI+数智员工”新赛道
据手机新浪网报道,夸夸菁领发布了两款面向增收场景的智能体产品,并把这一动作定位为企业级AI的“AI+数智员工”新赛道。报道认为,企业级AI的竞争重点正从通用能力展示,转向能够直接创造收入的数智员工落地。