PROVENANCE LOG · SOURCE-LINKED
来源与平台审计全录
收录 arXiv、GitHub、X、小红书、Reddit 与 Hacker News 的检索路径、可读性记录、入选理由和排除理由。
本页把仓库 Markdown 中的完整条目迁入网页。论文和项目中的数字均保留原始出处与实验前提;社交帖子用于追溯发现路径。
查看核验方法 →| 范围 | 本轮取得的材料 | 不能由此推断 |
|---|---|---|
| 官方信息 | TypeSafe 发布文章、文档、SDK changelog、状态页;四个网关及 LangSmith Evals 的官方资料 | 文档承诺已经由本仓库实测,或各网关规格完全相同 |
| X | 45 条不同帖文的作者、日期与可读取文本;32 条来自 X 官方嵌入接口,另 13 条来自 FxTwitter 镜像 | 全平台穷尽检索、所有长文与视频均完整读取、所有演示均复现 |
| GitHub | 51 个仓库的公开 API 元数据;对新增重点项目及部分旧条目另读 README / 结果文件 | 星数代表质量,或所有项目代码均经过审计 |
| 论文 | 6 篇原始论文页面,对其中涉及先前工作争议的两篇另读 HTML 正文(09-22 快照);09-24 增补 13 篇(09-19 至 09-22 首发),经 arXiv API 逐篇核对标题 / 作者 / 首发日期,内容取自摘要 | 这些是 Jev 官方论文(仍不存在),或摘要数字已被本仓库复现 |
| 工程与评测 | 作者博客、实验仓库、结果说明、创始人访谈及文字稿 | 不同样本、硬件、地区和计价口径可以直接合并排名 |
| 小红书 | 搜索页、9 个笔记链接及二级索引;未取得可核验的笔记正文 | 已完成平台内容覆盖,或标题中的速度 / 成本数字已经确认 |
正文优先引用官方页面、作者原帖、原始论文和代码。新闻聚合、HN 和其他 Awesome 列表用于发现线索,再回查出处。重复转述不算独立实验;社区假说、作者自报结果、待核验线索均作显式标记。
| 核验项 | 出处与本轮处理 |
|---|---|
| 发布时间、RLCD 定位、厂商工作流评测 | TypeSafe 发布文章 ↗;将速度与费用倍数限定到官方测量条件 |
| 模型版本、别名、价格、上下文与输入模态 | Models ↗;将 SDK 更新与模型升级分开 |
confidence 与 Noul | Confidence ↗;更正“自由文本自评”的旧解释,注明 Noul 无独立 confidence |
| 255 个候选项与能力边界 | Choice ↗、Jev 1.13 jaggedness ↗;不声称 API 自动切换为两阶段选择 |
| 不再需要候补名单、起始额度 | 官方开放公告 ↗、同线程额度回复 ↗ |
| Python 与 JS 使用方式 | Python changelog ↗、JS SDK ↗;补充 0.7.1、破坏性变化和独立包名 |
| Vercel 接入与限时活动 | 09-16 接入公告 ↗、09-19 活动原帖 ↗;不推断未公布的截止时区或账户条件 |
| Cloudflare / OpenRouter | Cloudflare 模型页 ↗、OpenRouter 模型页 ↗及官方 beta 公告 ↗ |
| LangSmith Evals / Gateway | 09-21 产品公告 ↗、Decision models 文档 ↗;区分 Jev BYOK、托管 SemIf 及其 09-28 免费期限与地区 / 计划限制 |
| 服务事件 | 官方状态页 ↗;09-20 Console 事件在 09-21 08:16 UTC 标为恢复,09-21 API 事件在 23:40 UTC 标为恢复;复读时页面更新标记为 09-22 07:28 UTC,显示服务在线 |
| 2026-09 论文潮(09-24 增补) | 线索来自 PaperWeekly 09-23 盘点 ↗;13 个 arXiv 编号经 arXiv API ↗ 逐篇核对标题、作者与首发日期(13/13 命中,其中 09-21 首发确为 6 篇);正文要点与数字取自各论文摘要;5 个配套 GitHub 仓库核对过 full_name 与星数(09-24 快照),未审计代码 |
| 2026-09-24 社区增补轮 | GitHub:jev-benchmarks、jev-arena、pi-warden、jev-codex-router、jev-hub、awesome-jev-cn 六个仓库经公开 API 核对 full_name 与星数;jev-benchmarks / jev-arena / jev-codex-router 另读 README 原文核对数字与免责声明。文章与文档:腾讯云 ADP 博客、Pydantic AI 文档、投资界(卡兹克授权转载,09-21)、虎扑(硅星人Pro 转载,09-20)、腾讯云开发者(程序员鱼皮)五篇 HTTP 可读并抽取关键数字;硅星人Pro 公众号原文返回验证墙、三个知乎入口自动抓取 403——知乎三篇已由维护者于 09-24 在浏览器确认可打开,正文要点待读取后补充。X:@rinte0321、@ctatedev、@yanhua1010 三条经 FxTwitter 镜像核对作者、UTC 时间与文本。小红书:DeepSleep 笔记访问返回“页面不存在”,仅按第三方索引列为待核验线索。无法读取的正文一律不采信其数字 |
| 2026-09-24 全库链接核查 | 10 个 Markdown 文件的 219 条外部链接、65 个 GitHub 仓库与全部内部锚点、相对链接逐一检查:GitHub 无 404,除 SemIf 已更名(SemIf-OpenJev ↗,README 与 CATALOG 同步更新)外无仓库改名;x.com、HN、Medium、Reddit、Substack、Discord、HuggingFace 等域名在本轮网络环境遭 DNS 污染不可达(其内容 09-22 已核验或经镜像可读),知乎 403(维护者浏览器确认可打开,正文待读)、小红书“暂无法浏览”跳转、businesswire 403、微信验证墙与既有条目标注一致;未发现新增失效链接。README 主标注据此更新为 2026-09-24(Asia/Shanghai) |
| 公司与融资 | 09-15 公司新闻稿 ↗;保留有出处的信息,删除未核实的估值与人物细节 |
以上都是日期快照。状态页会变化,模型别名、限流、价格与促销也应在实际使用前重查。
本轮重新打开 TypeSafe Models ↗:当前仍为 jev-1.13.0,jev-latest / jev-preview 均指向它,且暂无 preview。状态页 ↗显示 API / Console 在线,09-23 延迟事件及此前事件均为已恢复的历史记录。Vercel 的模型页 ↗写促销于 09-25 结束,但 09-26 页面仍显示 Free;未使用账户核对账单,故不宣称 09-26 仍免费或必然收费。接入公告 ↗仍保留旧促销文案。
- 框架与平台第一方材料:Pydantic Jev 模型文档 ↗、Evals 实例 ↗、Gateway 公告 ↗;Composio TypeSafe 文档 ↗及更新记录 ↗;Rig 主仓库 ↗标示 experimental;Ax 第一方站点源码 ↗;Vercel Connect ↗及eve 评估指南 ↗。Pydantic 的
LLMJudge/GEval已由正式文章确认,不能仅从旧 issue 推断。 - 社区仓库直接核验:TypeSafeAI 组织声明 ↗明确非官方;playground ↗区分 mock 和实时调用;harness ↗主体是离线契约、实时传输交给宿主。verdict ↗自述独立 wire-compatible 实现。TradingAgents ↗ 及其 v0.5.1 release ↗确认 Jev 仅是可选帖文筛选;PyGPT ↗ README / 2.8.31 changelog 明示 inline 插件。Convex 决策评测 ↗ 与主编码评测分开。未给这些新增条目填写易变的星数。
- 研究与原始记录:8 篇新论文的 arXiv 原页逐篇列于 RESEARCH.md;此前 13 个 ID 也重新打开检查仍可用,历史批次计数未当作当前总数。Jev-Benchmark ↗ 的
benchmark/providers.py、benchmark/protocol.py、data/provenance.json与docs/protocol.md直接核对 ContractNLI 和 Jev 原生调用;RLCDAlignBench ↗ 与受限访问数据卡 ↗核对数据范围和标签来源;JEV-Star ↗ README 保留有限样本与同时改动接口的限制。 - 未收录 / 未宣称:
reticlehq/reticle现有条目仍明确是计划集成,未提升为已支持;TypeSafeAI不归入官方;verdict不归入官方模型;playground 的 110 个示例数不复制进目录,避免高频维护;Jev in the Wild的 2,170 是论文方法下的 GitHub 样本,不是本仓库验证的集成数。暂不依据聚合站结果新增缺少代码或第一方证据的长尾项目。
直接帖子页受访问限制时,先读取 X 的公开嵌入接口,例如官方开放公告的嵌入数据 ↗。补充渠道为 FxTwitter 的同帖镜像 ↗;它是第三方服务,不是官方证据等级的替代品。
核对帖文 ID、作者、时间和文本,精选条目仍链接原始 X 地址。嵌入接口可能截断长帖:只引用实际取得的内容;需要实验细节时转向作者链接的仓库或文章。视频演示若未独立运行,只写“作者报告”。
正文 X 日期统一用 UTC。例如取消候补名单的帖子发布于 09-20 21:30 UTC,换算北京时间是 09-21 05:30;两种日期不是互相矛盾的公告。
访问了站内 Jev 搜索页 ↗。返回页面有搜索标题,但未包含可读取的笔记结果;这不能证明搜索无命中。详情页返回“当前笔记暂时无法浏览”、登录跳转或超时。当前会话也没有可用的已连接平台检索插件。
2026-09-24 补充:小红书近年为笔记直链引入 xsec_token(配合 xsec_source)安全校验与反爬参数,token 与会话 / 来源绑定且有时效;缺 token 或 token 失效时表现为登录跳转、“当前笔记暂时无法浏览”或 404 跳转。上述访问结果与该校验行为一致,不证明笔记已被删除;核验需在站内或携带有效 token 打开。
除第一条来自仓库旧记录外,其余标题和日期来自什么值得买的参考列表:A ↗、B ↗、C ↗。它们只用于发现链接,作者、发布日期及正文均未获平台原文复核。
| 索引日期 | 笔记链接 / 标题线索 | 访问结果 |
|---|---|---|
| 09-20,仓库旧记录 | 成了,用 cua 和 jev 实现电脑控制 ↗ | explore 页暂不可浏览;旧分享入口转登录;旧署名“北京月薪5k”未复核 |
| 09-20,B | Jev刚火两天,开源就杀疯了:0.5B就能跑! ↗ | 暂不可浏览;HTTP 成功返回的是错误提示页,并非笔记正文 |
| 09-20,B | 比Jev快50倍?本地部署直接原地起飞! ↗ | 暂不可浏览 |
| 09-20,A | 一个视频搞懂Jev! ↗ | 暂不可浏览 |
| 09-18,C | 给Codex配上Jev,真不想回去了 ↗ | 暂不可浏览 |
| 09-18,A | 一文了解 Jev 模型到底是啥 ↗ | 读取超时 |
| 09-16,A | 输出免费!前OpenAI研究员发布全新模型 ↗ | 读取超时 |
| 09-16,A | RLHF核心研究者发布新模型,称比LLM快200倍 ↗ | 读取超时 |
| 09-16,A | chatgpt联合创始人发布新模型jev ↗ | 读取超时 |
没有将“50 倍”“200 倍”或人物头衔写成事实。后续补充需给出可复核的作者、日期、正文或视频内容,以及性能数字的测试条件;满足后再移入正式精选。
- 检查官方发布文章、文档索引 ↗和访谈中的公开技术材料。
- arXiv:Jev TypeSafe ↗ 本轮返回无结果;补充搜索精确 RLCD 全称及 OpenReview,未找到匹配的官方论文。精确全称的 arXiv 检索页另一次访问超时,不将这次失败计作“零结果”。
- 09-24 论文增补:微信公众号文章可读取原文(HTML 直取,正文完整),但其角色只是发现线索;13 篇论文以 arXiv API 的
id_list批量查询 ↗为准,逐篇核对编号、标题、作者与首发日期,全部命中后才收录。文章的分组(首批应用 / Jev-Anything / 开源平替与挑错)与“09-21 一天 6 篇”的说法与 API 返回一致;文章没给出各论文作者,作者名单取自 API。关键词站内检索可能漏检,09-22 关于“未找到官方论文”的检索结论按原样保留。 - 阅读两篇先前工作预印本、校准基础论文、LLaDA / iLLaDA,以及同缩写但不同含义的 RLCD 论文;完整元数据与关联范围见 RESEARCH.md。
- 核对 judge 实验的 5 个独立轨迹、Archestra 的模型裁判一致子集、JevBench 的延迟修正、中文实验的 40 个样本与阈值选择方式。
sysone-bench最初按main抓取失败,后确认默认分支为master,成功读取 README、两版报告、硬件信息与原始 Jev JSON;核算为 541 条状态、751 个计分判断,更正作者概述的口径。未调用付费 API,也未重新训练或跑基准。
星数取自公开 GET https://api.github.com/repos/{owner}/{repo} 返回的 stargazers_count,另核对 full_name、默认分支与描述。51 个仓库成功取得元数据;后续请求遇到匿名 API 限流时停止补取,未取得的数值用 —,不沿用旧星数冒充新快照。功能与实验描述另以 README 和结果文件为准。
本轮还修正了这些容易误导读者的内容:
- Vercel 采用情况文章实际为 09-18,Sean Goedecke 文章为 09-16;HN 收录日单独注明。
AbdelStark/awesome-typesafe已重定向至awesome-typesafe-jev;官方 JS 仓库是typesafe-sdk-js。- Kev 已扩展到 Qwen3.5 模型族;jevlike 是独立研究实现;Reticle 将 Jev 集成列为尚未交付的计划。
- 不从 GitHub fork 推断技术血缘,不把平台搜索总量当成有效 Jev 项目数,也不保留未经核验的点赞快照。
- 聚合页中出现晚于本轮日期的更新条目时排除;新闻媒体首页不充当具体报道的来源。
链接可读取、文档语法正确与实验可复现是不同层次的验证。本轮完成的是资料整理与文档核对,仍需持续跟进服务和社区变化。
本轮为新的 Jev on Robotis / Robotics 与 手把手 Jev 页面做定向核验。检索 Jev Robotis、Jev ROBOTIS、site:github.com/ROBOTIS-GIT Jev 与 GitHub 仓库搜索,未发现可引用的一手 ROBOTIS 品牌集成;因此保留 Robotis 为用户提出的检索词,但不把它写成品牌案例。
- 机器人项目与元数据:通过 GitHub API 核对 jev-drone ↗、jev-arm-lab ↗、jev-robotics-demo ↗、Jev for Physical AI ↗、Jev + VLA ↗ 和 jev-robotics-radar ↗ 的仓库名称、说明、创建 / 更新时间与许可证;同时读取其 README。项目被按“仿真已运行 / 作者测量 / 设计阶段”标注,不按 star 数排序。
- 可由材料支持的范围:
jev-drone说明 Jev 在符号化视觉状态上约 2.5 Hz 作战术判断,并把高频飞控和安全反射留给代码;jev-arm-lab公开了任务层判断、日志与故障图谱;jev-robotics-demo只提供各一条记录运行;jev-physical-ai的 300 个事件来自模板化模拟,README 明示非真实机器人与非生产准确率;jev-vla自述设计阶段、没有可用接入或测量结果;jev-robotics-radar是官网文本评分工具,不是机器人控制或事实核查研究。 - 入门资料:重新对照 官方 Quickstart ↗、API Reference ↗、Python SDK ↗、JavaScript SDK ↗、Confidence ↗、confidence-gated routing ↗ 和 intent routing ↗。教程示例未使用账户密钥发起推理,
0.70只作为策略结构示例,不作为推荐阈值。 - 网页层:
docs/index.html、docs/hands-on.html、docs/robotics.html、docs/assets/site.css和docs/assets/site.js是仓库内纯静态界面,不加载分析脚本、第三方字体或用户数据;页面链接到 Markdown 原文,方便审查、离线阅读和 GitHub Pages 发布。
这次按来源分别复查;这里记录的是可追溯结果和排除理由,不是平台热度榜。
- arXiv:通过 公开 API ↗ 拉取按首发时间倒序的 100 条命中。9 月 25 日至本次检查没有新增
Jev命中;但 9 月 24 日索引中补到此前遗漏的 JevOut ↗、渗透测试 harness 案例 ↗ 和 企业编码 Agent 路由研究 ↗。三篇标题、作者、首发时间和摘要都由 API 重核,正文结论仍按作者报告收录。 - GitHub:用 Repository Search 的
Jev TypeSafe、首发 / 更新日期过滤寻找 09-25 至 09-27 的项目,再读重点 README 和逐仓库 API 元数据。新增 JEV-Drive ↗ 到 Robotics(有 AlpaSim 运行路径与局部 rollout,非实车),新增 jev-ticket-triage ↗ 到评测目录(公开方法和图表,结果未独立复现),并在入门页链接 Building with TypeSafe Jev ↗(第三方技能)。其余大量新建、零星或 README 不完整的项目没有逐条入库。 - Hacker News:以 Algolia 的按时间检索接口 ↗ 复查。09-26 的 Just Ask Jev ↗ 帖只是指向已收录的 arXiv 原文,且没有可补充的实质讨论;因此只更新审计记录,不把 HN 帖当作新的技术证据。
- X:检索
Jev、TypeSafe与日期组合时,公开搜索索引没有返回可核验的新单帖;直接 X 搜索在当前会话受访问限制。未把搜索摘要、转述或点赞数写入目录。 - 小红书:尝试打开站内
Jev搜索页,连接被平台关闭(ERR_CONNECTION_CLOSED),未取得笔记正文。既有笔记继续是待核验线索;没有据标题、二级索引或截图补写速度、成本或实战效果。
第一轮只以少量可直接读取的帖子为证据,覆盖不足。本轮补读 Jev Guide 的公开 GitHub 索引 ↗:其 2026-09-27 提交的 最新列表 ↗ 按原帖日期列出 X 链接,并明确说明标题、摘要和分类是编辑整理。该索引在仓库 README 中标示为 3,215 条整理记录与 1,701 段原帖视频;这些是索引作者的计数,不是本库核验的生态总量。
- 以索引发现线索后,逐个回到 GitHub API 与 README。9 月 27 日的 Gmail filter 原帖 ↗ 对应 可读源码仓库 ↗,已收录并写明邮件字段外传边界;AI-DLC gate ↗ 也经源码与测试说明核对后收录。
- 扩大 X 线索对应的 GitHub 复查后,再收录了 System One Connector ↗、Jev MCP ↗、jev-gate ↗ 和 Jev IDS ↗。逐个读取 README、许可证和 GitHub 元数据;其中路由和 IDS 的数值均保留为作者在限定基准与条件下的报告,并写进适用边界。
- 未把 交易盈利提醒 ↗、单次游戏分数、社交媒体浏览量、单次速度 / 成本或没有代码的 demo 放进正式目录。它们可帮助发现项目,不能单独证明收益、准确率、安全性或可复现性。
- 小红书仍没有取得可读正文:公开搜索不返回站内笔记,且站内页关闭连接。因此本轮没有把任何“小红书同名账号”“活动入口”或二级索引转写为笔记内容;等待能打开的原帖或作者提供的可访问来源。
用户在内置浏览器完成 X 与小红书登录后,站内搜索和笔记正文可读。这改变了“能否发现线索”,不改变收录标准:帖子只负责指向候选;功能、许可证、权重、评测条件和限制须回到项目原始材料复核。
- X → TypeLLM:发现帖 ↗ 指向 TypeLLM ↗。仓库 README、许可证和
evals/jevbench说明支持“基于 SGLang 的类型化生成”、图像输入、依赖字段,并报告在 231 个公开 JevBench 任务上的 195/231(无 thinking)和 228/231(thinking)。这些是维护者报告;目录链接到其方法与逐题结果,不把它写成独立基准排名。 - 小红书 → OmniJev:项目作者帖 ↗ 指向 官网 ↗、GitHub ↗ 和 Hugging Face 权重 ↗。源码 README 证实 0.8B、2B、4B 的 choice / score / noul 接口与公开演示,同时明确机器人内容是离线回放,可靠闭环机器人控制尚未建立;训练清单仍在审计。因此它收录到 Robotics 与开放模型,而不写成实机控制成果。
- 小红书 → JEMM:“多模态 JEV 类模型”笔记 ↗ 指向的线索与 ypcypc/JEMM ↗ 仓库匹配。README 证实其为 Apache-2.0、开源权重、基于文本或截图的 Jev-like 服务,使用
/v1/systemone协议;要求至少 64 GB CUDA GPU,并明确不隶属 TypeSafe AI。笔记中的性能数字没有脱离原始评测条件单独宣传。 - 广泛性与排除项:站内搜索还出现很多自动化、机器人、论文解读和“开源复刻”帖子。没有可回溯代码、论文或作者材料的内容仍保持为发现线索,不纳入项目目录;UniIntervene ↗ 虽在机器人相关笔记中被标注 Jev,但其原始 README 描述的是 agentic intervention / VLA 训练管线而非 Jev 集成,故不作为 Jev 项目收录。
在社交平台线索之外,本轮再以 Jev、TypeSafe AI、System One、robotics / VLA 组合与 09-15 至 09-27 创建日期检索 GitHub,先排除重复的 awesome 列表、空仓库、无 README 条目和只含营销结论的项目;再逐个读取 README、许可证和仓库元数据。新增的可审查项目覆盖:Agent skill 与编程工作流(Hermes Jev Skills、Astra-Ares、JevHarness)、本地决策模型(LLM2Jev)、仿真机器人(RoboJEV)、文档处理(docjev)和数据策展(jev-curate)。所有性能、成本和成功率保留为作者在具体数据、硬件或回放条件下的报告,未重跑付费调用,也未将社交媒体热度计入筛选标准。
没有匹配条目。请尝试更短的关键词。