搜索

在 Viewer 组合中的原生文本搜索

Doconut Viewer 提供普通搜索,使用格式查看器提取的文本或基于文本的 PDF 重定向。它需要 Search 许可证功能。

启用搜索 UI

Search 是 Viewer 模块,而不是独立的工具栏。完整页面必须包含 Viewer 资源、Viewer 工具栏、Viewer 挂载点以及已初始化的 objViewer;随后会挂载并附加 Search 功能区到同一实例上。

Search 和 annotation 是内置的授权功能,而非 AddPlugin<T>() 包。请从注入的 Viewer 请求搜索资源;只有在许可证授予 Search 时才会发出相应标签。

html
@Html.Raw(Viewer.ReferenceCss(new CssConfig
{
    IncludeViewerCss = true,
    IncludeSearchCss = true
}))

@Html.Raw(Viewer.ReferenceScripts(new ScriptConfig
{
    IncludeJQuery = true,
    IncludeViewerScripts = true,
    IncludeSearchScripts = true,
    IncludeSearchBar = true
}))

嵌入的功能区调用与自定义 UI 相同的 JavaScript 方法。

在标记中保持完整的 Viewer 组合可见,先初始化 docViewer,随后附加已授权的功能区:

html
<nav id="toolbar" aria-label="Document viewer controls">
    <!-- Viewer controls, including the button that opens Search -->
</nav>
<div id="searchBarMount"></div>
<div id="divDocViewer"><div id="div_ctlDoc"></div></div>

<script>
    let searchBar = null;
    let currentToken = '';

    const objViewer = $('#div_ctlDoc').docViewer({
        BasePath: '/doconut',
        ResPath: '/doconut-res/images'
    });

    @if (Viewer.IsSearchEnabled)
    {
        <text>
    searchBar = $('#searchBarMount').doconutSearchBar({
        docId: 'ctlDoc',
        getRequestParams: () => ({ token: currentToken }),
        onStatus: (message) => console.log(message),
        onToast: (message, type) => console.log(type, message),
        onLayout: () => requestAnimationFrame(() => objViewer.Refit())
    });
    searchBar.attach(objViewer);
        </text>
    }
</script>

该组件注入 Find、Options 和 Results 组,并处理搜索、清除、匹配计数以及前/后匹配导航。主机拥有的 Viewer 工具栏只需切换它:

javascript
searchBar.isOpen() ? searchBar.close() : searchBar.open();

其公开 API 故意保持简洁:

方法用途
attach(objViewer)将功能区连接到已初始化的 viewer;仅需调用一次
open() / close()显示或隐藏功能区;关闭时同时清除高亮
reset()清除当前搜索词、结果计数和高亮
isOpen()报告功能区是否可见
setStatus(message)通过配置的回调转发状态信息

可选的 onToggle(isOpen) 回调让主机同步其 Search 按钮,onLayout 则在功能区高度变化时让其重新调整/适配 viewer。有关组合 Viewer、Search 与 Annotation 的启动顺序,请参阅快速入门

从 JavaScript 进行搜索

javascript
objViewer.Search(keyword, false, function (resultCount) {
    console.log('Matches:', resultCount);
});

第二个参数表示全词/精确匹配。回调后可使用:

方法结果
SearchMatchCount()文档中所有单独匹配的总数。
SearchSummary(false)返回 [pageNumber, matchCount] 条目且不重新绘制。
SearchSummary(true)同上并绘制页面/缩略图高亮。
GotoSearchMatch(index)跳转到基于零的匹配索引。

中间件路由使用 search=<term>exact=true|false 并返回 XML。请使用小部件 API,而不是自行解析内部响应。

检查搜索能力

初始化响应会报告:

text
X-Doconut-Can-Search: 1

初始化后,objViewer.CanSearch() 会返回相同的格式/会话判定。当服务器返回 0 时返回 false;在收到响应之前,或服务器较旧而未返回该标头时,默认返回 true

有三道独立的门不可混淆:

问题
CanSearch() / 响应标头已解析的 viewer 是否具备原生索引/搜索路径?
AllowSearch此格式配置是否请求了文本提取(即开关存在)?
LicenseCapability.Search应用是否被授权执行搜索并获取 UI 包?

一种格式在技术上可以搜索,但当前许可证可能拒绝该操作。

为每种格式启用提取

csharp
var token = await viewer.OpenDocumentAsync(path, new PdfConfig
{
    AllowSearch = true,
    AllowCopy   = true   // optional: lets the user drag a region and copy its text
});

AllowSearchAllowCopy 同时存在于 PdfConfigWordConfigExcelConfigPptConfig 中。Office 属性会委托给其嵌套的 PdfConfig。两者默认均为 false

PDF、Word、Excel、PowerPoint、TXT、Visio、email、EPUB 与 MHT 均有原生搜索适配器。XPS 默认使用其 PDF 路径。HTML 与 Microsoft Project 可受益于基于文本的 PDF 重定向:

csharp
// DefaultRender = false → converted to a text-based PDF → searchable
var token = await viewer.OpenDocumentAsync(path, new HtmlConfig { DefaultRender = false });

对于原生渲染器,CanSearch() 描述 viewer 能力;但并不保证特定文档包含可用文本。页面仅为扫描图像的 PDF 仍可能返回零原生结果。

普通搜索行为

服务器按以下顺序尝试搜索来源:

  1. 原生 ISearchableViewer 结果。
  2. 预构建的 .srh 搜索索引。
  3. 当不存在搜索来源时返回错误/空结果。

即使特定扫描文档没有文本层,CanSearch() 仍可能对可搜索的 viewer 返回 true,此时会返回零匹配。

许可与 UI 行为

临时/演示许可证在有效期内授予 Search。缺少许可证或旧的 TRIAL 文件则不授予 Search 功能。没有 Search 时:

  • ReferenceCssReferenceScripts 会省略搜索相关的 bundle。
  • 中间件会拒绝搜索请求,而不是返回已授权的结果。

通过 IDoconutLicenseService.IsCapabilityGranted(LicenseCapability.Search) 驱动自定义 UI 可见性,并使用 CanSearch() 获取格式/会话的独立判定。

故障排除

症状检查
搜索栏缺失检查搜索能力以及 IncludeSearchCss/IncludeSearchScripts/IncludeSearchBar 是否已包含
CanSearch() 为 false检查格式查看器、所选 DefaultRender 路径以及初始化响应标头
扫描 PDF 的搜索返回零文档没有文本层;请使用包含文本的来源或保留文本的 PDF 投影
搜索工作但高亮偏移检查渲染路径、分辨率、文档变换以及提取的单词框

此页面有帮助吗?