文档导航

Cookbook 合集

Cookbook 合集

端到端实战范例,展示 TypeSafe 如何解决真实问题 —— 从几个问题到完整流水线。

每个 cookbook 都是一个完整的示例:一份真实数据集、一组就它做出判断的 TypeSafe 问题,以及把这些判断变成一个可用系统的代码。当你想看原语和模式如何在一个具体问题上结合起来时,可以读一读;也可以直接抄一份,作为你自己项目的起点。

本节假定你已经了解 TypeSafe 原语,也理解置信度是如何工作的。如果没有,请先读那两页。

自洽性

重复做同一个决策,把多次运行之间的一致程度当作信号。

Cookbook 做什么 难度
自洽性:noul 把不确定的概率路由给人工复核,同时让底层的 noul 值保持可见。 入门
自洽性:choice 给审核决策增加一个“不确定”结果,并比较标签一致程度与自动处置的比例。 入门

批处理

把许多问题打包进一次请求。

Cookbook 做什么 难度
并行问题 就 GDPR 的维基百科条目跑一遍 13 个问题的合规简报,展示把所有问题批处理进一次 TypeSafe 调用后,成本降低 12.2 倍、速度提升 10.0 倍,而答案毫无变化。 入门

操作指南

常见任务的范例:搜索、格式化、工具选择、防护栏。

Cookbook 做什么 难度
重排序 为 40 条 CLERC 法律查询各构建 30 个段落的 BM25 候选列表,再用每个“查询-候选”对一个 TypeSafe 问题,把 top-1 准确率从 5% 提升到 18%,top-10 准确率从 38% 提升到 62%。 入门
逐行搜索 为 GitHub 的服务条款构建语义搜索。在一次请求中,用一个 Choice 问题给 218 个行 id 相对一句大白话查询打分,再用一个 Noul 问题检查文档里到底有没有答案。 入门
结构还原 用两次请求从丢失了格式的纯文本重建 Markdown:一次把硬换行的行重新拼起来,一次对每个块(标题、列表、代码、提示框)分类。 入门
函数调用 把自然语言的交易请求变成对普通类型化函数的调用,做法是把函数名和闭集参数映射成带置信度的 TypeSafe 问题。 中级
技能建议 从 Nous Research 的 Hermes 目录里的 182 个技能中,为某一轮 agent 交互挑出至多一个,用两次 TypeSafe 请求对头部候选做排序和复查。 中级
知识图谱实体对齐 用一个 Score 问题加三个配套 Noul,判断两份啤酒目录中的 450 个候选对里哪些描述的是同一款产品,并呈现是哪些字段不一致。 入门
为 RAG 段落分类 用一次 TypeSafe 请求给每个检索到的段落打分,再在代码里决定哪些段落交给作答模型。 中级
复核引用 对照源文档检查,抓出错误或凭空捏造的引用。一个 Choice 问题判断引文的上下文是否支持该论断。 入门
LLM 防护栏 用一次 TypeSafe 请求筛查进出一个 LLM 应用的每条消息,对危害概率和严重程度取阈值,以放行、复核、拦截或路由。 中级

抽取

从杂乱的文本中抽取类型化的值。

Cookbook 做什么 难度
SDE 级联 用一条两阶段的结构化数据抽取级联(mini → 验证 → 推理)以很小的成本拿到大推理模型的大部分质量。 中级
日期抽取 让 TypeSafe 读出文档中提到的日期各部分,再在代码里解析并校验,并用置信度做复核,从而抽出绝对日期和相对日期。 入门
预解析的值抽取 用正则找出候选的邮箱、电话号码和金额,再让 TypeSafe 选出所需的那一段,以便代码规范化出一个原样保留的值。 入门

分类

把输入分配到任意深度的类别中。

Cookbook 做什么 难度
层级分类 借助 TypeSafe Choice 概率上的并行束搜索,把文档穿过深层的专利、零售商品、生物医学和源码层级进行分类。 中级
自动研究式特征发现 跑一个自动研究循环:提出 TypeSafe 问题,把自由文本转成数值特征,再用模型误差来改进一个有监督的 CatBoost 回归器。 高级
用置信度分类 用一个 Choice 把 SEC 年报分到 75 个行业组,再读答案自身的置信度,决定是报该组还是它上面更宽的一级。 入门