新书推介:《语义网技术体系》
作者:瞿裕忠,胡伟,程龚
   XML论坛     W3CHINA.ORG讨论区     计算机科学论坛     SOAChina论坛     Blog     开放翻译计划     新浪微博  
 
  • 首页
  • 登录
  • 注册
  • 软件下载
  • 资料下载
  • 核心成员
  • 帮助
  •   Add to Google

    >> DTD, XML Schema(XMLS), RELAX NG
    [返回] 中文XML论坛 - 专业的XML技术讨论区XML.ORG.CN讨论区 - XML技术『 DTD/XML Schema 』 → 请教大侠:如何从PDF中自动抽取元数据,转化XML文档 查看新帖用户列表

      发表一个新主题  发表一个新投票  回复主题  (订阅本版) 您是本帖的第 2560 个阅读者浏览上一篇主题  刷新本主题   树形显示贴子 浏览下一篇主题
     * 贴子主题: 请教大侠:如何从PDF中自动抽取元数据,转化XML文档 举报  打印  推荐  IE收藏夹 
       本主题类别:     
     xinlv 美女呀,离线,快来找我吧!
      
      
      等级:大一新生
      文章:6
      积分:81
      门派:XML.ORG.CN
      注册:2004/10/29

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给xinlv发送一个短消息 把xinlv加入好友 查看xinlv的个人资料 搜索xinlv在『 DTD/XML Schema 』的所有贴子 引用回复这个贴子 回复这个贴子 查看xinlv的博客楼主
    发贴心情 请教大侠:如何从PDF中自动抽取元数据,转化XML文档

    偶要做一个项目,从给定的一篇PDF文档中自动抽取出元数据,并用xml进行表示.
    偶根本不知如何从PDF文档中自动抽取数据.想必是从分析PDF格式表示开始吧.可是偶却不知要看什么书.哪位大侠能推荐看介绍pdf格式的书,助偶一臂之力.急呀!
    谢了!
    文字
    文字
       

       收藏   分享  
    顶(0)
      




    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2004/10/29 11:12:00
     
     Mooner 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:4
      积分:68
      门派:XML.ORG.CN
      注册:2004/10/14

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给Mooner发送一个短消息 把Mooner加入好友 查看Mooner的个人资料 搜索Mooner在『 DTD/XML Schema 』的所有贴子 引用回复这个贴子 回复这个贴子 查看Mooner的博客2
    发贴心情 
    基本上,这个,很难。。。
    我第一次听说从PDF生成XML
    以前只知道XML借助XSLT可以转为PDF。。。。。
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2004/11/8 17:30:00
     
     hello105 帅哥哟,离线,有人找我吗?
      
      
      等级:大二(研究汇编)
      文章:36
      积分:229
      门派:XML.ORG.CN
      注册:2004/6/8

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给hello105发送一个短消息 把hello105加入好友 查看hello105的个人资料 搜索hello105在『 DTD/XML Schema 』的所有贴子 引用回复这个贴子 回复这个贴子 查看hello105的博客3
    发贴心情 
    有一个开源的包pdfbox,可以在sourceForge上找到,基于xml得所以因该能很方便的实现
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2004/11/8 18:53:00
     
     xinlv 美女呀,离线,快来找我吧!
      
      
      等级:大一新生
      文章:6
      积分:81
      门派:XML.ORG.CN
      注册:2004/10/29

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给xinlv发送一个短消息 把xinlv加入好友 查看xinlv的个人资料 搜索xinlv在『 DTD/XML Schema 』的所有贴子 引用回复这个贴子 回复这个贴子 查看xinlv的博客4
    发贴心情 
    谢谢两位!
    前几天,我听人说先看perl的书,就会有答案了.
    请问hello105,
    你说的开源的包pdf和sourceForge,指的是什么呀?
    我一点都不懂,你能告诉我该看什么书吗?
    非常感谢!
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2004/11/9 11:17:00
     
     hello105 帅哥哟,离线,有人找我吗?
      
      
      等级:大二(研究汇编)
      文章:36
      积分:229
      门派:XML.ORG.CN
      注册:2004/6/8

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给hello105发送一个短消息 把hello105加入好友 查看hello105的个人资料 搜索hello105在『 DTD/XML Schema 』的所有贴子 引用回复这个贴子 回复这个贴子 查看hello105的博客5
    发贴心情 
    http://sourceforge.net/index.php
    sourceforge是一个开源项目的集散地,可以找到很多你需要的开源的东西
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2004/11/10 12:34:00
     
     GoogleAdSense
      
      
      等级:大一新生
      文章:1
      积分:50
      门派:无门无派
      院校:未填写
      注册:2007-01-01
    给Google AdSense发送一个短消息 把Google AdSense加入好友 查看Google AdSense的个人资料 搜索Google AdSense在『 DTD/XML Schema 』的所有贴子 访问Google AdSense的主页 引用回复这个贴子 回复这个贴子 查看Google AdSense的博客广告
    2024/11/10 20:30:01

    本主题贴数5,分页: [1]

    管理选项修改tag | 锁定 | 解锁 | 提升 | 删除 | 移动 | 固顶 | 总固顶 | 奖励 | 惩罚 | 发布公告
    W3C Contributing Supporter! W 3 C h i n a ( since 2003 ) 旗 下 站 点
    苏ICP备05006046号《全国人大常委会关于维护互联网安全的决定》《计算机信息网络国际联网安全保护管理办法》
    6,968.750ms