2. Methodology
Retrieval-augmented generation improves factuality by grounding model outputs in external knowledge.
Figure 1. Overview of the cache-assisted retrieval pipeline.
上传 PDF,按页翻译、段落定位、术语库加持——论文、报告、合同,读得懂,也用得上。
Retrieval-augmented generation improves factuality by grounding model outputs in external knowledge.
Figure 1. Overview of the cache-assisted retrieval pipeline.
检索增强生成通过外部知识为模型输出提供依据,从而提高事实准确性。
本文提出一种面向检索增强生成的高效知识缓存机制,在保持回答质量的同时减少重复检索。
实验结果表明,该方法可降低首个词元时间,并在多种数据集上保持稳定表现。
支持带可复制文字层的 PDF,论文、报告、合同拖入即可。
识别专业领域,命中你的术语库;逐页出译文,翻到哪读到哪。
原文 PDF 与译文同步滚动,点击段落互相定位;译文可整段复制到你的稿件。
不是把 PDF 塞进机翻框或者 AI 对话框,而是一套面向论文与长文档的阅读式翻译工作台。
左侧是原文 PDF,右侧是译文。点击任一段译文,原文自动定位到对应位置;核对公式、图注和引用时不用来回翻页。
Retrieval-augmented generation improves factuality by grounding model outputs in external knowledge.
Figure 3 shows a stable relationship between cache hit rate and retrieval latency.
Full results and parameter settings are reported in the appendix.
Figure 3. Ablation results在消融实验中,缓存命中率与检索延迟之间呈现稳定关系。
图 3 展示了不同缓存配置下的结果。
完整结果见附录中的参数设置。
翻译时自动命中你的术语库,专业词汇前后统一,译文更贴合你所在领域的表达习惯。
识别文档所属专业与使用场景,据此匹配术语库和翻译策略——学术、商务、技术文档,各说各的行话。
当前支持 20 页以内、带可复制文字层的 PDF,例如论文、报告和电子书导出文件。纯扫描件没有文字层,可先用 WordsTalk 的 PDF OCR 工具在浏览器本地识别文字,再进行翻译。
会。PDF 文件会提交到 WordsTalk 服务器用于解析和翻译,并按照隐私政策处理。
按整篇 PDF 实际翻译的原文字符扣减账户的快速字数额度。点击“开始翻译”后会翻译整篇 PDF,暂不支持选择部分页面翻译。余额不足时会先翻译到可用额度耗尽的位置,已译页保留,补充后继续。
已完成页面的译文会保留。重新进入页面即可从中断处继续翻译;个别失败的页面支持单独重试,不影响其他页。
进入工作台,上传 PDF 即可免费体验,术语库随时可用。