墨坛书屋 通过搜索各大小说站为您自动抓取各类小说的最快更新供您阅读!

“本来是这样的。”周至乐得眼睛都眯缝了:“可是两位师兄提供的字卡太好用了。”

“《字海》的字卡,有编号,有大字,有拼音、民国拼音、甚至还有老四角号码,还有小字的释义和凡例,满足了我们自动识别软件对于调试校准模型的一切要求,我们当然也要用到那头去!”

周至又道:“有了字卡的辅助,我们很快便将软件识别图形文字的准确率,从百分之九十二,也就是一百个字错八个,提升到了百分之九十九点六,也就是依靠软件识别文字,一千个字里只会读错四个。直接提升了一个量级。”

“这个成就,也直接帮我们跨过了数字图书馆最后一个巨大门槛,这个软件,已经算是真正成熟了。”

“这次带来的数字化的《字海》,就是我们第一本通过计算机扫描识别技术建立起来数字图书,既然字数最多的《字海》都可以实现数字化,那对其余典籍,我们当然充满了信心!”

“那就是古籍数字化工作可以提上日程了?”韦一心大喜:“我们学校正在搞《四库全书丛目》这部大书,要不肘子你来我们学校?学籍什么的好说……”

一边计算机中心主任也连连点头:“其实清华那边没去头,肘子你到底是文科生,来我们这儿正好搞古籍数字化工程,想想看,这个大工程搞出来,那会是多大成就?古人说的君子三立,立德立功立言,不都在里边了?”

周至听得心中暗笑,应该说北大的文化氛围的确可以的,你看计算机中心主任都说得出君子三立这样的命题解读来……

不过这事儿暂时没有可能,周至只好笑着解释:“我们蜀大的《道藏》,《儒藏》两部大书也准备开修了,师爷爷是不可能放人的。”

“不过现在有了好工具,哪怕我不来北大,大家也能够加快工程的进度。现在还是说回正事儿,我利用数字化的《字海》,演示一下我们对数字典籍整理的工程架构协议及标准。”

这个东西是周至的自创,哪怕上一世,这也是图书典籍工程里没有过的东西。

直到周至穿越回来之前,国家将典籍进行数字化的工作,主要还停留在建立树状数据库的较为原始的应用阶段。

就好比一个标准的图书馆,将一本书作为一个文本文件整体存放,然后给这个文件编出,书名,书号,最多再给出个作者,出版社之类的信息,作为标签。

这样做的好处就是简单明了,升级维护也容易,信息保存也算全面,一句话说完,就是够用,但不好用。

这样的东西在周至眼里当然是不合格的,最多最多只能算是地基,离百尺高塔还差着老远的功夫。

信息工程就是这样,算法和协议的思路,往往比基础工作还要重要,如果指导思想发生了错误,等到工程进展到不敷使用,才想着改弦易辙,在已经叠房架屋的情况下,再要开展,将付出巨大的代价。

后世中文编码的巨大混乱情形,就是这种教训的最好注脚。

这些思路,是在四叶草的研发思想,周至提出来的“如何三问”原则思想指导下梳理出来的。

“如何三问”听着玄奥,其实很简单质朴,就是对于任何需求,我们要问三层以上的问题。

比如典籍数字化工程,按照一般的思路,好不好用?

答案肯定:不好用。

那第一个如何就来了:如何让它好用?

答案也简单:除了将一部部书籍扫描成文本文档外,还要在这个基础上,建立起一个庞大的标签体系和智慧搜索引擎。

那第二个如何就来了:如何建立起一个庞大的标签体系和智慧搜索引擎?

答案就是需要一个能够根据文档内容,自动化地分析提取特征标签的标签采集软件;要完成智慧搜索引擎,又需要一个球网状的数据拓扑关联系统。

那第三个如何就来了:我们如何开发这个标签采集软件和球网状的数据拓扑关联系统。

答案就是软件硬件并行,软件上,利用现在最新的数学统计学原理,引入计算机模型当中,开发出一套特征提取算法和特征联动算法,并将这套算法作为指导思想,完成软件开发。

硬件上,要克服现有计算设备算力不足的情况,就利用网络时代的助力,将广域网上的所有算力资源都最大程度地利用起来,研发出基于互联网基础的分布式算力应用系统。

这套理念现在还比较初步,但是根据这个理念建立起来的数字化《字海》,却非常的清晰明白,周至还牵头发明了一套论述体系,通过三维图层的方式来讲解一页字卡上,各项内容之间的复杂关联关系。

这隔着图示讲解下,韦一心和冷玉龙就能够看见平面化的字卡,变成了一个类似秸秆蝈蝈笼子,或者说像折叠式灯笼打开后的样子,各个图层之间通过算法将每一层的特征标签连接起来,构成了字卡的立体结构。

对于这一套思维体系,学文科的人理解起来甚至比学理科的还要容易,跟计算中心的曾教授,周至还要讲解一番,而两位老师兄却看得倍感舒适。

因为在两位老师兄的脑海中,关于字卡的知识体系,就和周至现在在信息系统里展现出来的那样!

冷玉龙开心地鼓起掌来:“妙极,妙极!什么叫青出于蓝,这就叫青出于蓝!谁能想到有一天书本的每一页会变成立体的?!哈哈哈哈,这是我们花了多少年才在脑海里构建起来的东西,现在却一目了然了,这个数字图书,有点东西啊!”

刚刚周至给他们讲的很多技术细节他们也闹不明白,但是这些技术细节支撑起来的应用却让他们太熟悉了,不由得生出了一种“他乡遇故知”的惊喜感。

“五四时期的诸多贤达,曾对我们的国学失望至极,认为汉字都没有存在的必要,或者字符化。”周至笑道:“这是一种毫无依据的悲观估计,然而直到今天,这样的流毒居然还有市场,那就实在是匪夷所思了。”

“这话也不能空说。”两位老师兄都是踏踏实实搞学术的人,冷玉龙就说道:“你得拿出足够强大的理由来,不然不就是又犯了五四学人的错误?”

墨坛书屋推荐阅读:一世倾城(邪王追妻:废材逆天小姐)光灵行传婚情不负:腹黑总裁恋逃妻宠妻入骨:神秘老公有点坏兵王传奇医武兵王陆轩重生空间之少将仙妻你是我的难得情深不是戏神从明星野外生存秀开始穿成反派BOSS的小娇妻农女致富记走出深渊,我即是深渊都市小保安战神医婿江辰唐楚楚全集免费阅读下载弃女重生:神医太子妃乾坤剑神四合院:不要算计我红包游戏:我提现了商业帝国医术助我拿下狂傲夫君不死武皇一世倾城直播:在线放牧,我有万亩草原最豪赘婿高端食材供应商这重生不太对劲美食:随机摆摊,顾客疯狂抢购庞医生的小嗲精重生80年代好日子岳风柳萱免费阅读大结局开局主角上门?我成他姐夫!化身系统,宿主莫慌,我来了!炼狱孤行者高武:开局修改锻体法震惊世界我演化的物种,都叫我创世神道士不好惹(又名:古井观传奇)神级逗比系统温水煮沫沫慕林灰雾灭世,我是行走吸尘器糟糕!假死脱身后被女主逮住了奉旨抢亲,纨绔太子喜当娘末世玄学大佬在年代文躺赢斗罗之诸天降临游戏降临:龙国预知一切吓哭全球蚀骨缠绵:痴情阔少强宠妻老衲要还俗穿回现代直播他们羡慕哭了至尊保安总统大人,借个婚!
墨坛书屋搜藏榜:锦云谋票房女王安哥拉风云2009龙虎香江亲手亲嘴把十八线小明星养成天后诸天猎杀者看到成功率,我被相亲对象绑架了校园绝品医王重生之一路随心隐婚总裁的小祖宗甜哭了婚约对象是七位师姐,我要退婚!神医龙婿绝地大探险第一符师:轻狂太子妃解甲归甜(重生)怀孕后,前任小叔找上门要负责东宫禁宠带着空间当熊猫米豆和他的体验屋超级军工霸主系统绑错,我躺赢成仙田园神豪苟在都市修个仙四合院里的喜剧重生八零之军少的毒妻惊!王妃一脚踹翻了王爷的轮椅天生媒运华娱从仙剑开始曹军打赏女主播,我能无限提升修为我有一个万能系统商城都市:霸道总裁爱上我郡主当道:美男有点多闪婚之秘爱成瘾都市至尊医仙七零,恶毒女配奋斗日常私宠:婚前试爱神临觉醒:我成为异世五条悟森罗大帝最强狂兵山晋江湖,我全家都是黑道系统让我当贤妻良母龙族之从挖卡塞尔墙角开始重启白金时代重生为君我的灵器被妹妹直播抽奖了夫人虐渣要趁早全书反派都宠她爱上秦楼重生八零奶萌包占卜师:基础能力干翻全世界
墨坛书屋最新小说:九阴诡案管理局港片悍警莽夫,专暴各种不服武术决斗之王净身出户暴富,我的桃花炸了世界变成游戏,我是唯一玩家末世从AI觉醒开始崛起!我在现代却捡到修仙功法一颗红星,来陕北卖物资!重生成狗之护农重托全球御兽:系统送我神宠?死后重生,反派娇妻已灭世!无涯桎梏开局大日真经,校花女鬼被炼化我有小姨管后院,你们有吗莫欺中年穷,情报系统助我成为首富下山后才发现,这孽徒强的过分!我于人间无敌,镇守边关十万年我家病娇女仆的占有欲有点强四合院:截胡系统开局躺赢离婚后摊牌了,我修仙的!都市炼宝传奇港片:曹老板,专嚯人家墙角重生变成白毛萝莉,解锁傲娇系统牛冲天邻居姐姐请不要打扰我四合院之文艺人生离婚后,我的神豪游戏成真了老爸,你也重生了?九霄玄天神帝权力争锋神级纨绔偶遇村花洗白白,被当成流氓下山后,我成了国民男神你出轨在先,我和学姐领证你哭什么装失忆找初恋,我走你哭什么?重生77,这个怨种我不当了误入五哈,从此进军文娱圈!初与末的故事1全民:觉醒虫族主宰,一秒孵一虫!重生1979:开局成为卖炭翁重生:这一世成为至尊重生80:打猎喂饱小娇妻兵王重生七零年:开局白得美娇妻尘渊启示录神农传承:我的农业天赋觉醒了开局复刻校花神级天赋,她反手提剑上门网游:开局掠夺进阶天赋体修的乐园之旅世界版本更新:战姬召唤师地皮继承:请叫我天景之主!