Advertisement

Pointer-Generator-Networks-in-Chinese-Summarization:基于Trans...

  • 5星
  •     浏览量: 0
  •     大小:None
  •      文件类型:None


简介:
本文介绍了一种在中文文本摘要中应用的Pointer-Generator-Network模型,并结合Transformer架构优化了生成式摘要的效果。通过实验验证,该方法显著提升了摘要的质量与连贯性。 在中文数据集下使用指针生成网络(Pointer Generator Network, PG-N)来生成摘要的工作中,我将原论文中的特征抽取方法从单层双向LSTM改为采用BERT的embedding结构。模型的整体框架没有改变,但工程上的处理细节进行了调整。(注意,并未直接使用完整的BERT模型)。中文数据集包含250万篇新闻文章(原始数据大小为9GB,压缩后3.6GB;时间跨度为2014年至2016年)。 对于分词工作,我提供了相应的代码:new-point-generate-zh。在运行tokenizer时,请使用如下命令: ``` python main.py --original_data_dir E:\0000_python\point-genge\point-generate\zh\data --tokenized_dir ./tokenized_single ```

全部评论 (0)

还没有任何评论哟~
客服
客服
  • Pointer-Generator-Networks-in-Chinese-Summarization:Trans...
    优质
    本文介绍了一种在中文文本摘要中应用的Pointer-Generator-Network模型,并结合Transformer架构优化了生成式摘要的效果。通过实验验证,该方法显著提升了摘要的质量与连贯性。 在中文数据集下使用指针生成网络(Pointer Generator Network, PG-N)来生成摘要的工作中,我将原论文中的特征抽取方法从单层双向LSTM改为采用BERT的embedding结构。模型的整体框架没有改变,但工程上的处理细节进行了调整。(注意,并未直接使用完整的BERT模型)。中文数据集包含250万篇新闻文章(原始数据大小为9GB,压缩后3.6GB;时间跨度为2014年至2016年)。 对于分词工作,我提供了相应的代码:new-point-generate-zh。在运行tokenizer时,请使用如下命令: ``` python main.py --original_data_dir E:\0000_python\point-genge\point-generate\zh\data --tokenized_dir ./tokenized_single ```
  • Information Theory in Networks
    优质
    《Information Theory in Networks》是一本探讨网络信息理论及其应用的著作,深入分析了数据传输、编码和网络安全等领域的核心问题。 关于网络信息论方面的书非常出色!这样的书籍在探讨网络信息论方面提供了极佳的见解和知识。
  • Information Theory in Networks
    优质
    《信息论在网络中的应用》探讨了如何将信息理论的基本原理应用于网络通信中,以优化数据传输效率和可靠性。该书深入分析了编码、解码及信道容量等关键概念,并提供了实际案例来展示其在现代互联网技术中的重要性。 这部全面介绍网络信息理论及其应用的著作首次对经典成果与最近进展进行了统一阐述。书中采用平衡的新模型引入与新编码技术讲解的方法,引导读者从香农点到点的信息论逐步深入至单跳、多跳网络及分布式计算、保密通信和无线通讯等扩展领域。全书使用了基本的概率知识,并基于几个简单的引理来证明编码定理,因此适合初学者阅读理解。 书中涵盖了诸如连续消除与叠加码技术、MIMO(大规模输入输出)无线通信系统、网络编码以及合作中继等关键主题。此外还讨论了反馈和交互式通讯机制、容量近似及缩放法则,并涉及非同步和随机访问通道等方面的内容。这本书非常适合用于教学,自学或作为工业界与学术界的工程师和研究人员的参考书目。
  • Bayesian Networks: Examples in R
    优质
    本书《Bayesian Networks: Examples in R》通过丰富的R语言实例,深入浅出地介绍了贝叶斯网络的基本概念、构建方法及应用技巧。适合统计学和机器学习领域的读者阅读与实践。 经典图书《Bayesian Networks With Examples in R》包含大量实例,方便学习。
  • Bayesian Networks: Examples in R.pdf
    优质
    《Bayesian Networks: Examples in R》一书通过丰富的R语言实例,深入浅出地介绍了贝叶斯网络的概念、构建和应用方法。 使用R语言实现贝叶斯网络,并包含各种案例以深入讲解贝叶斯模型的结构学习、参数学习和推理三部分内容。
  • Compressive Sensing in Wireless Networks
    优质
    《Compressive Sensing in Wireless Networks》探讨了压缩感知技术在无线通信网络中的应用,包括信号处理、数据传输和资源管理等方面。 Publisher: Cambridge University Press Date of Publication: July 31, 2013 Authors: - Zhu Han (University of Houston) - Husheng Li (University of Tennessee Knoxville) - Wotao Yin (Rice University, Houston) Language: English ISBN 10: 1107018838 ISBN 13: 978-1107018839
  • Fully Convolutional Networks in Semantic Segmentation
    优质
    本文探讨全卷积网络在语义分割领域的应用,通过利用该技术实现像素级分类,从而有效提升图像理解精度与效率。 Fully convolutional networks are used for semantic segmentation.
  • Graph-Theoretic Approaches in Multi-Agent Networks
    优质
    本文探讨了图论在多智能体网络中的应用,分析了利用图论方法解决分布式控制、协调与优化问题的有效策略。通过研究节点间的相互作用和信息传播机制,提出了增强网络鲁棒性和效率的算法框架。 这本书提供了一种易于理解的介绍动态多代理网络分析与设计的方法。此类网络在科学和技术领域的广泛领域内都极具兴趣,包括移动传感器网络、分布式机器人(如编队飞行及群集)、量子网络、网路经济学、生物同步化和社交网络等。 本书聚焦于图论方法来对动态多代理系统进行分析与综合,并介绍了一种强大且新颖的形式主义及其工具。全书分为基础理论,多智能体网络以及将网络视为系统的三个部分。作者首先概述了图论中的重要概念,接着详细介绍了协议和其各种扩展版本的行为表现,包括该协议在无向、有向、切换及随机网络上的运作情况。 书中还探讨了诸如编队控制、覆盖范围分析、分布式估计等主题,并涉及社交网络与博弈理论在网络环境下的应用。此外,本书通过将这些网络视为系统来研究其动态演变过程以及使用单纯复形模型探究高阶交互作用模式及其实际用途,进一步探索了一些有趣的研究视角。 该书适合研究生在控制系统和计算机科学及机器人技术方面学习时参考,并且对于寻求全面了解多智能体系统的体系结构理论及相关广泛应用的科研人员来说是一本标准参考资料。这本书已被德国斯图加特大学、瑞典皇家理工学院、美国乔治亚理工大学、美国华盛顿大学以及美国俄亥俄州立大学等高校选为教材使用。
  • Graph-Theoretic Approaches in Multi-Agent Networks
    优质
    本文探讨了图论方法在多智能体网络中的应用,通过分析节点和边的关系来优化网络结构与功能。 Mehran Mesbahi 和 Magnus Egerstedt 合著的《Graph Theoretic Methods in Multiagent Networks》是 Princeton Series in Applied Mathematics 系列的一部分,由 Princeton University Press 出版于 2010 年。
  • Neural Networks in Applied Sciences and Engineering
    优质
    《Neural Networks in Applied Sciences and Engineering》是一本探讨神经网络在工程与科学应用中的理论和实践的专著,涵盖了从基础概念到高级技术的广泛内容。 为了应对分析海量数据需求的指数级增长,《应用于科学与工程领域的神经网络:从基础到复杂模式识别》一书为科学家们提供了一种简单而系统的介绍神经网络的方法。本书首先讨论了在科学研究中使用神经网络的作用,然后介绍了基本的神经网络概念,并提供了实用的数据分析所需的各种架构概述。 书中详细解释了线性网络和多层感知器(用于非线性预测与分类)的所有处理阶段及模型开发过程,通过实际案例和研究来说明。随后的部分深入探讨自组织映射在网络中进行非线性数据聚类的应用、循环神经网络在时间序列预测中的作用以及其他适用于科学数据分析的网络类型。 该书采用易于理解的形式,并使用了大量的图形化解释帮助读者快速掌握复杂的数学概念;同时,书中还详细讨论了模型开发的所有阶段和结果解读过程,包括数据预处理、维度降低、输入选择等。Sandhya Samarasinghe在俄罗斯卢蒙巴大学获得机械工程硕士学位,在美国弗吉尼亚理工大学分别获得了硕士及博士学位。她的神经网络研究涵盖了理论理解和实际应用两个方面。