“特别能聊”的人工智能会聊出些什么?******
聊天机器人ChatGPT优异表现引发市场关注,人工智能生成内容概念走上风口
“特别能聊”的人工智能会聊出些什么?
本报记者 时斓娜
阅读提示
全新人工智能聊天机器人模型ChatGPT不仅能够通过学习人类的语言来进行对话,还能根据聊天的上下文进行互动,让人们更直观地感受到了人工智能的魅力。包括内容生成、搜索引擎增强等在内的领域,将是其潜在的产业化方向。ChatGPT的商业化落地,还需要克服技术和科技伦理等方面的问题。
家里要养一只猫,该如何给猫取名字?怎样写出一个纸牌游戏的代码?在不同语境中,词语“意思”到底有几个意思?这些五花八门、时常令人绞尽脑汁都难以得出答案的问题,在人工智能聊天机器人ChatGPT的面前,不过是瞬间便可迎刃而解的“一碟小菜”。
产品发布短短两个月,ChatGPT的日活量已突破千万,不少人“聊过”之后惊呼“这太像真正的人类了”。其超预期的表现引发越来越多的市场关注,人工智能生成内容(AIGC)概念由此走上风口。
人工智能聊天究竟能聊些啥?ChatGPT所代表的AIGC应用将带来哪些影响和变化?记者对此进行了调查采访。
“真正像人类一样聊天交流”
“我所热爱的是我真实的生活,因为它包含了我所有的经历和感受,是我每一天都在体验和思考的。”这句乍看上去充满了人类体悟和情感的话,实则出自人工智能聊天机器人ChatGPT。
随着ChatGPT大火,不少网友将它与自己的聊天记录分享到社交平台上,ChatGPT时而诙谐有趣,时而又显得思想深邃。除了各种聊天互动外,还有不少网友们将ChatGPT视为一种工具,让其写作文、翻译文章,甚至写代码。迅速的响应能力和较为靠谱的回答让大家直呼其“真正像人类一样聊天交流”“特别能聊”。
中国信息通信研究院联合中国人工智能产业发展联盟对ChatGPT进行的测试显示,ChatGPT在百科检索、数学问答、文学交流、常识问答、知识推理等对话任务上的意图识别率均达到98%左右,在生活闲聊上的意图识别率约为95%,已具备较好的语义理解能力。
实际上,ChatGPT属于生成式人工智能的一个典型应用。人工智能是怎样“进化”得如此智能的?“这是因为ChatGPT建立在大型语言模型上,会通过连接大量的语料库来训练模型。这些语料库包含了真实世界中的对话和各种网络公开信息,使ChatGPT知识丰富,还能根据上下文进行互动。”深度科技研究院院长张孝荣表示。
创新交互为AIGC带来新启发
随着人工智能技术的发展,近年来AIGC类型不断丰富、质量不断提升、技术的工程化水平越来越高,国内外科技公司纷纷发力布局AIGC领域。
以百度文心大模型为例,输入一个题目,它可以瞬间写出上百篇作文;根据一句话或者一段描述文本,可以生成一幅精美的画作;根据一幅图像,可以自动生成高清、流畅的视频。
在百度技术委员会主席吴华看来,ChatGPT在用户界面和交互上是一种比较创新的模式,用户更容易以自然语言的方式进行交互,这会给大家带来革新性的认识,也会给AIGC带来新的启发。
目前,国外一些公司在积极探索并落地ChatGPT的诸多应用场景,通过将ChatGPT整合进搜索引擎等方式提高服务智能化水平。有观点认为,ChatGPT将颠覆搜索行业,在智能客服、游戏、虚拟人等领域也将得到广泛应用。硅谷投资机构红杉预测,未来AIGC有潜力产生数万亿美元的经济价值。
根据中国信息通信研究院发布的《人工智能白皮书(2022年)》,“生成式人工智能”技术将广泛应用于智能写作、代码生成、有声阅读、新闻播报、语音导航、影像修复等领域,听说读写等能力的有机结合成为未来发展趋势。
“人工智能生成在诗歌、作曲、绘画等艺术创作方面大放异彩,在分子结构、软件代码等科研生产领域的应用不断拓展,还帮助降低临床试验的科研成本和缩短研发周期。”云计算与大数据研究所内容科技部副主任石霖表示,当前,人工智能生成内容的辐射范围还在扩大,未来有望重塑各行业领域的研发面貌。
商业化落地需克服技术和伦理问题
尽管各界对AIGC发展前景保持乐观,但从现状来看,ChatGPT等产品想要真正落地,还需要克服技术和科技伦理等方面的问题。
在对ChatGPT进行的种种评测中,ChatGPT会犯一些常识性错误,反映出其在可控性、准确率方面仍存不足。有人形容,ChatGPT像极了一个很能聊但有时候喜欢信口开河的人类朋友。
中国信息通信研究院评测结果同样显示,ChatGPT在非闲聊型对话的任务完成率上表现一般,难以摆脱传统深度学习模型普遍存在的知识整合和逻辑推理的问题。
“ChatGPT虽然能够较好地回答不少问题,但在一些略有深度的、专业性较强的领域,其答案往往‘捉襟见肘’。这说明ChatGPT语料库规模和计算能力的天然不足,也说明了算法依然需要完善。”张孝荣说。
在技术层面以外,人工智能还面临着悬而未决的科技伦理问题。张孝荣表示,ChatGPT在科技伦理方面至少面临三大挑战:“一是版权问题,ChatGPT生成的内容更多来自搬运,容易引发侵权;二是信息安全问题;三是社会缺乏接纳这一新生事物的准备机制,这对监管挑战很大。”
在国内,AIGC产业化路径同样有待探索。石霖介绍说,国内AIGC产业基础薄弱,相关初创公司数量明显少于国外。同时,国内企业目前仍处于打磨产品阶段,还未出现较为好用的内容生成服务。
构建数据基础制度体系的有力举措******
作者:江小涓(中国行政管理学会会长)、白京羽(国家发展和改革委员会创新驱动发展中心主任)
习近平总书记指出:“数据基础制度建设事关国家发展和安全大局,要维护国家数据安全,保护个人信息和商业秘密,促进数据高效流通使用、赋能实体经济,统筹推进数据产权、流通交易、收益分配、安全治理,加快构建数据基础制度体系。”近日印发的《中共中央国务院关于构建数据基础制度更好发挥数据要素作用的意见》(以下简称“数据二十条”),明确了数据要素市场制度建设的基本框架、前进方向和工作重点,对于构建数据基础制度、推进数据要素市场建设、更好发挥数据要素作用具有重要意义。
把数据作为继土地、劳动力、资本、技术之后新的重要生产要素,是数字经济发展的必然要求。首先,数据的爆炸式增长和大规模流通应用,推动大数据中心、移动基站等基础设施投资规模持续增长,激发电商、社交、娱乐等数字消费提质增效,促进产业互联网、智能产业等数字生产提速放量,加快数字贸易发展,为稳住宏观经济大盘、促进经济持续增长提供强劲动力。其次,数据要素的高效利用,能够汇聚海量信息并进行智能匹配,克服资源配置中的信息壁垒,形成供需互促、产销并进的良性互动,有利于用好国际国内两个市场、两种资源。再次,数据大规模流通应用,能够产生常规条件下难以获得的新信息、新能量,有利于促进颠覆性创新,催生出新技术新产品新业态新模式。最后,与传统生产要素不同,数据可以被多次复制共享,这决定了数据要素在市场化应用的同时也可以大量应用于公共服务的多个场景,提升公共服务的可及性、普惠性、均等化水平,促进经济发展成果普惠共享。
与传统生产要素相比,数据要素具有产权复杂性、交易多元化、技术依赖性强等特征。“数据二十条”既把握数据同其他生产要素的共性,又把握数据要素的特性,提出了有针对性的措施。
处理好数据产权和使用权的关系。数据参与生产、交换、消费、分配,所有权是绕不开的问题。这主要是因为数据尤其是有价值的大数据,其产生过程往往伴随着多个主体,导致确定数据产权的问题较为复杂。“数据二十条”并不回避数据要素的复杂产权问题,同时更强调使用权,提出“探索数据产权结构性分置制度”,要求“根据数据来源和数据生成特征,分别界定数据生产、流通、使用过程中各参与方享有的合法权利”,从而在总体框架上采用结构性分置,具体操作上采用分类分级确权授权使用,创造性提出建立数据资源持有权、数据加工使用权和数据产品经营权“三权分置”的数据产权制度框架,构建中国特色数据产权制度体系。这既符合社会认知基础、数据要素特点、事物发展规律,也为今后继续探索留下足够空间。
处理好场内交易和场外交易的关系。目前市场上的数据交易方式,既有数据交易所形式的场内交易,也有企业与企业之间直接发生数据交互的场外交易。场内交易一定程度上利于监管,但需付出额外成本;场外交易虽灵活多样,却易出现违规行为。对此,“数据二十条”提出“完善和规范数据流通规则,构建促进使用和流通、场内场外相结合的交易制度体系,规范引导场外交易,培育壮大场内交易”,并在完善数据全流程合规与监管规则体系、统筹构建规范高效的数据交易场所、培育数据要素流通和交易服务生态等方面提出指导意见,为探索建立合规高效、场内场外结合的数据要素流通和交易制度指明了前进方向,也有利于探索更优的数据交易方式。
处理好数据共享和数据安全的关系。公共数据体量巨大、价值含量高,无论是社会治理还是产业发展,都迫切需要使用公共数据。“数据二十条”对公共数据的开发利用作出规定,主基调是坚持开放共享,强调“推进实施公共数据确权授权机制”,鼓励公共数据在保护个人隐私和确保公共安全的前提下,按照“原始数据不出域、数据可用不可见”的要求,以模型、核验等产品和服务等形式向社会提供,对不承载个人信息和不影响公共安全的公共数据,推动按用途加大供给使用范围。也要看到,可以无条件开放的公共数据是有限的,大部分公共数据具有一定敏感性。在这方面,“数据二十条”要求“依法依规予以保密的公共数据不予开放,严格管控未依法依规公开的原始公共数据直接进入市场,保障公共数据供给使用的公共利益”。这些规定为在确保数据安全的前提下,最大限度促进公共数据的高效利用和要素价值释放提供了有力制度保障。
还要看到,数据的大规模流通应用对数据安全相关技术创新发展提出了更高要求。近年来,市场上已经出现了一些维护数据安全的技术,如隐私保护计算和区块链技术等,为解决数据安全与数据流通之间的矛盾提供了可能选项。“数据二十条”高度重视数据安全相关技术创新发展,鼓励探索数据流通安全保障技术、标准、方案;支持开展数据流通相关安全技术研发和服务,促进不同场景下数据要素安全可信流通;提出以“揭榜挂帅”方式支持有条件的部门、行业加快突破数据可信流通、安全治理等关键技术。这对于实现以数据安全技术保障数据合理使用、以数据使用促进数据安全技术持续发展具有重要推动作用。
(文图:赵筱尘 巫邓炎)