收录甲骨数量最多 清华大学发布《甲骨文摹本大系》******
光明日报北京12月19日电(记者邓晖)十年磨一剑,一部甲骨文资料整理的集大成之作面世。清华大学出土文献研究与保护中心日前发布了《甲骨文摹本大系》(以下简称《大系》)新书。该书收录有字甲骨70659片,是目前收录甲骨数量最多的大型甲骨著录书,将为研究者更深入地做好卜辞分类与分期研究、文字考释工作与甲骨学商史研究带来极大便利。
《大系》是第一部以摹本形式按照新的理论和方法综合整理研究甲骨文资料的集大成之作,把原本“庞杂无序”的已刊布的7万多片有字甲骨整理成井井有条的科学资料。全书共43册,由“图版”“释文”和“索引”三部分组成,正八开刊印。据悉,2012年至2022年,清华大学出土文献研究与保护中心黄天树教授率领其甲骨团队编纂《大系》,通过选择良拓、剔除伪片、删除重片、缀合残片、分类断代、制作摹本、撰写释文、编制索引等工作,历时十年,终于告竣。
与《甲骨文合集》等著录书相比,《大系》全书采用“两系”新说代替“五期”旧说,编排7万多片甲骨材料,开创了甲骨著录书编纂的新范式。
“董作宾创立五期说,凿破鸿蒙,意义深远。但是,其弊病是把甲骨字体分类和王世的推定混在一起了。今天,甲骨学者认识到,卜辞的字体分类与断代是两个不同的步骤,我们应先根据字体等特征分卜辞为若干类,然后分别判定各类所属时代。这是甲骨断代理论和研究方法上的重大突破。”黄天树介绍。
《大系》还精心为每版甲骨制作了摹本。甲骨作为珍贵的文物,学者很难接触到实物,因而研究甲骨文,主要依据甲骨著录书公布的拓本、照片和摹本。这三种图版各有优劣,可以取长补短。高质量的甲骨摹本,可以立体显示各种甲骨信息,为甲骨初学者提供参考。
此外,《大系》还给每一版有字甲骨标注了字体类别。黄天树介绍,殷墟甲骨文是最早的古汉语资料。但是,甲骨文要作为语料来运用的先决条件,便是要确定其时代。否则,10多万片甲骨依然是一堆“断烂朝报”,缺少科学价值。“字体类别的确定,意味着这版甲骨的时代已经得到推定,大大增加了作为史料的研究价值。”
20多年来,甲骨缀合成果层出不穷,新拼缀出来的甲骨缀合多达3000多组。其中有些甲骨缀合极为重要,复原出前所未见的新材料,极大地丰富了学界对殷商社会的认识。然而,团队成员发现,这些甲骨缀合成果分散在各种甲骨缀合专书、刊物和学术网站上,应用起来不太方便。
“《大系》收录2020年12月之前的所有缀合成果,省去学者翻检之苦。我们还撰写释文,编制索引。读者如果要查看相应甲骨拓本,通过《大系》索引可以检索到,十分便捷。”黄天树介绍。
《光明日报》( 2022年12月20日 11版)
“特别能聊”的人工智能会聊出些什么?******
聊天机器人ChatGPT优异表现引发市场关注,人工智能生成内容概念走上风口
“特别能聊”的人工智能会聊出些什么?
本报记者 时斓娜
阅读提示
全新人工智能聊天机器人模型ChatGPT不仅能够通过学习人类的语言来进行对话,还能根据聊天的上下文进行互动,让人们更直观地感受到了人工智能的魅力。包括内容生成、搜索引擎增强等在内的领域,将是其潜在的产业化方向。ChatGPT的商业化落地,还需要克服技术和科技伦理等方面的问题。
家里要养一只猫,该如何给猫取名字?怎样写出一个纸牌游戏的代码?在不同语境中,词语“意思”到底有几个意思?这些五花八门、时常令人绞尽脑汁都难以得出答案的问题,在人工智能聊天机器人ChatGPT的面前,不过是瞬间便可迎刃而解的“一碟小菜”。
产品发布短短两个月,ChatGPT的日活量已突破千万,不少人“聊过”之后惊呼“这太像真正的人类了”。其超预期的表现引发越来越多的市场关注,人工智能生成内容(AIGC)概念由此走上风口。
人工智能聊天究竟能聊些啥?ChatGPT所代表的AIGC应用将带来哪些影响和变化?记者对此进行了调查采访。
“真正像人类一样聊天交流”
“我所热爱的是我真实的生活,因为它包含了我所有的经历和感受,是我每一天都在体验和思考的。”这句乍看上去充满了人类体悟和情感的话,实则出自人工智能聊天机器人ChatGPT。
随着ChatGPT大火,不少网友将它与自己的聊天记录分享到社交平台上,ChatGPT时而诙谐有趣,时而又显得思想深邃。除了各种聊天互动外,还有不少网友们将ChatGPT视为一种工具,让其写作文、翻译文章,甚至写代码。迅速的响应能力和较为靠谱的回答让大家直呼其“真正像人类一样聊天交流”“特别能聊”。
中国信息通信研究院联合中国人工智能产业发展联盟对ChatGPT进行的测试显示,ChatGPT在百科检索、数学问答、文学交流、常识问答、知识推理等对话任务上的意图识别率均达到98%左右,在生活闲聊上的意图识别率约为95%,已具备较好的语义理解能力。
实际上,ChatGPT属于生成式人工智能的一个典型应用。人工智能是怎样“进化”得如此智能的?“这是因为ChatGPT建立在大型语言模型上,会通过连接大量的语料库来训练模型。这些语料库包含了真实世界中的对话和各种网络公开信息,使ChatGPT知识丰富,还能根据上下文进行互动。”深度科技研究院院长张孝荣表示。
创新交互为AIGC带来新启发
随着人工智能技术的发展,近年来AIGC类型不断丰富、质量不断提升、技术的工程化水平越来越高,国内外科技公司纷纷发力布局AIGC领域。
以百度文心大模型为例,输入一个题目,它可以瞬间写出上百篇作文;根据一句话或者一段描述文本,可以生成一幅精美的画作;根据一幅图像,可以自动生成高清、流畅的视频。
在百度技术委员会主席吴华看来,ChatGPT在用户界面和交互上是一种比较创新的模式,用户更容易以自然语言的方式进行交互,这会给大家带来革新性的认识,也会给AIGC带来新的启发。
目前,国外一些公司在积极探索并落地ChatGPT的诸多应用场景,通过将ChatGPT整合进搜索引擎等方式提高服务智能化水平。有观点认为,ChatGPT将颠覆搜索行业,在智能客服、游戏、虚拟人等领域也将得到广泛应用。硅谷投资机构红杉预测,未来AIGC有潜力产生数万亿美元的经济价值。
根据中国信息通信研究院发布的《人工智能白皮书(2022年)》,“生成式人工智能”技术将广泛应用于智能写作、代码生成、有声阅读、新闻播报、语音导航、影像修复等领域,听说读写等能力的有机结合成为未来发展趋势。
“人工智能生成在诗歌、作曲、绘画等艺术创作方面大放异彩,在分子结构、软件代码等科研生产领域的应用不断拓展,还帮助降低临床试验的科研成本和缩短研发周期。”云计算与大数据研究所内容科技部副主任石霖表示,当前,人工智能生成内容的辐射范围还在扩大,未来有望重塑各行业领域的研发面貌。
商业化落地需克服技术和伦理问题
尽管各界对AIGC发展前景保持乐观,但从现状来看,ChatGPT等产品想要真正落地,还需要克服技术和科技伦理等方面的问题。
在对ChatGPT进行的种种评测中,ChatGPT会犯一些常识性错误,反映出其在可控性、准确率方面仍存不足。有人形容,ChatGPT像极了一个很能聊但有时候喜欢信口开河的人类朋友。
中国信息通信研究院评测结果同样显示,ChatGPT在非闲聊型对话的任务完成率上表现一般,难以摆脱传统深度学习模型普遍存在的知识整合和逻辑推理的问题。
“ChatGPT虽然能够较好地回答不少问题,但在一些略有深度的、专业性较强的领域,其答案往往‘捉襟见肘’。这说明ChatGPT语料库规模和计算能力的天然不足,也说明了算法依然需要完善。”张孝荣说。
在技术层面以外,人工智能还面临着悬而未决的科技伦理问题。张孝荣表示,ChatGPT在科技伦理方面至少面临三大挑战:“一是版权问题,ChatGPT生成的内容更多来自搬运,容易引发侵权;二是信息安全问题;三是社会缺乏接纳这一新生事物的准备机制,这对监管挑战很大。”
在国内,AIGC产业化路径同样有待探索。石霖介绍说,国内AIGC产业基础薄弱,相关初创公司数量明显少于国外。同时,国内企业目前仍处于打磨产品阶段,还未出现较为好用的内容生成服务。
(文图:赵筱尘 巫邓炎)