前往小程序,Get更优阅读体验!
立即前往
发布
社区首页 >专栏 >组件分享之后端组件——docconv组件将文档转换为纯文本

组件分享之后端组件——docconv组件将文档转换为纯文本

作者头像
cn華少
发布2022-03-06 09:13:47
发布2022-03-06 09:13:47
72700
代码可运行
举报
文章被收录于专栏:IT综合技术分享IT综合技术分享
运行总次数:0
代码可运行

组件分享之后端组件——docconv组件将文档转换为纯文本

背景

近期正在探索前端、后端、系统端各类常用组件与工具,对其一些常见的组件进行再次整理一下,形成标准化组件专题,后续该专题将包含各类语言中的一些常用组件。欢迎大家进行持续关注。

组件基本信息

内容

本次分享的组件是用于将PDF, DOC, DOCX, XML, HTML, RTF, ODT,页面文档和图像转换为纯文本使用的,该组件是基于Golang语言开发的,具体使用如下:

代码语言:javascript
代码运行次数:0
复制
package main

import (
    "fmt"
    "log"

    "code.sajari.com/docconv"
)

func main() {
    res, err := docconv.ConvertPath("需要转换的文件.pdf")
    if err != nil {
        log.Fatal(err)
    }
    fmt.Println(res)
}

读取远程文件使用如下:

代码语言:javascript
代码运行次数:0
复制
package main

import (
    "fmt"
    "log"

    "code.sajari.com/docconv/client"
)

func main() {
    // 使用默认端点创建一个新客户端 (localhost:8888)
    c := client.New()

    res, err := client.ConvertPath(c, "your-file.pdf")
    if err != nil {
        log.Fatal(err)
    }
    fmt.Println(res)
}
本文声明:

本作品由 cn華少 采用 知识共享署名-非商业性使用 4.0 国际许可协议 进行许可。

本文参与 腾讯云自媒体同步曝光计划,分享自作者个人站点/博客。
原始发表:2022.01.17 ,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 作者个人站点/博客 前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体同步曝光计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
目录
  • 组件分享之后端组件——docconv组件将文档转换为纯文本
    • 背景
    • 组件基本信息
    • 内容
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档