<?xml version="1.0" encoding="UTF-8"?>
<!DOCTYPE article PUBLIC "-//NLM//DTD JATS (Z39.96) Article Authoring DTD v1.4 20240229//EN" "JATS-articleauthoring1.dtd">
<article article-type="research-article" xml:lang="zh-CN" xmlns:xlink="http://www.w3.org/1999/xlink">
  <front>
    <journal-meta>
      <journal-id journal-id-type="publisher-id">8</journal-id>
      <journal-title-group>
        <journal-title>《科技研究》</journal-title>
      </journal-title-group>
      <issn>ISSN:3079-9244（原2717-5480）</issn>
      <publisher>
        <publisher-name>华文科学出版社</publisher-name>
      </publisher>
    </journal-meta>
    <article-meta>
      <article-id pub-id-type="publisher-id">3591</article-id>
      <title-group>
        <article-title>GATs-CSE：基于图注意力网络的对比学习句子嵌入</article-title>
      </title-group>
      <contrib-group>
        <contrib contrib-type="author">
          <string-name>姜兴华1张伟1</string-name>
        </contrib>
      </contrib-group>
      <pub-date pub-type="epub">
        <year>2024</year>
        <month>4</month>
      </pub-date>
      <issue>4</issue>
      <abstract>
        <p>对比学习句子嵌入存在两种训练方式，一种是端到端的方式，如SimCSE[3]，另一种是动量对比的方式，如ESimcse[4]，在自然语言领域的动量对比学习对数据量非常敏感，训练时鲁棒性较差。对此我们提出了GATs-CSE，一种无监督对比学习句子嵌入框架。该框架采用孪生网络的方式进行训练，分别由动态网络和静态网络两部分构成，为了保证句子嵌入的信息完整性，采用图注意力网络对语义信息抽取器提取出的所有信息进行信息交互，在通过权重残差连接的方式补充句子嵌入中残缺信息，剔除句子嵌入中的噪声信息。该框架避免了动量更新时语义信息抽取器参数更新的混乱性，解决了NLP领域中采用队列的方式进行对比学习时，对比样本对队列长度的敏感性。在文本语义相似任务上，斯皮尔曼相关系数平均超过SimCSE[3]2.33个百分点，高于ESimCSE[4]0.31个百分点。同时我们进行了大量的消融实验以证该框架在对比学习中的有效性。</p>
      </abstract>
    </article-meta>
  </front>
</article>
