设置同一次可复现生成
自然输入会按当前24条语料的词表做最长匹配;页面显示的token切分不代表其他模型。
用24条可见语料建立1-gram、2-gram和3-gram模型。改变上下文、温度与随机种子,逐步查看候选概率;再把生成句子放回材料中核查。
自然输入会按当前24条语料的词表做最长匹配;页面显示的token切分不代表其他模型。
固定参数和种子后,另一组应能复现同一结果。
点击“低温/高温对照”。
| 步 | 有效上下文 | 候选及概率 | 选中 | 是否回退 |
|---|---|---|---|---|
| 生成后显示。 | ||||
所有句子都有编号和章次,可检查、可替换。模型只从这些token序列统计。
本页是可解释的频率模型,不含神经网络、注意力和预训练参数。它只能帮助观察生成机制的一部分。
覆盖同义前文、阶数、温度、种子、长生成和材料外问题。允许根据结果改任务说明,不改语料事实。
尚未运行。
本区不以“越流畅越高分”评价。能暴露断链、主题漂移和材料外生成,才有修订价值。
| 编号 | 变量 | 前文 | 输出摘要 | 回退 | 观察 |
|---|---|---|---|---|---|
| 运行后生成。 | |||||
自动初筛只比较词语、数字和否定关系,最终状态必须查看原文后确认。
设置锁定后一次运行,包含直接支持、同义改写、错误数字、否定冲突和材料外事实。
尚未运行。
| 编号 | 句子 | 期望状态 | 初筛状态 | 依据 |
|---|---|---|---|---|
| 运行后生成。 | ||||
导出内容包含语料版本、生成参数、逐步概率、挑战结果和核查记录,不包含账号或外部对话。
资源版本:secondary-v3.0 / ch06-lab-0.1 不联网、不调用外部模型、不把生成文本标为事实。