<?xml version="1.0" encoding="UTF-8"?>
<oai_dc:dc xmlns:oai_dc="http://www.openarchives.org/OAI/2.0/oai_dc/" xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xsi:schemaLocation="http://www.openarchives.org/OAI/2.0/oai_dc/ http://www.openarchives.org/OAI/2.0/oai_dc.xsd">
  <dc:title>R Implementation of Wordpiece Tokenization</dc:title>
  <dc:title>R package wordpiece version 2.1.3</dc:title>
  <dc:description>Apply 'Wordpiece' (&lt;arXiv:1609.08144&gt;) tokenization to input text, 
 given an appropriate vocabulary. The 'BERT' (&lt;arXiv:1810.04805&gt;) tokenization 
 conventions are used by default.</dc:description>
  <dc:type>Software</dc:type>
  <dc:relation>Depends: R (&gt;= 3.3.0)</dc:relation>
  <dc:relation>Imports: dlr (&gt;= 1.0.0), fastmatch (&gt;= 1.1), memoise (&gt;= 2.0.0),
piecemaker (&gt;= 1.0.0), rlang, stringi (&gt;= 1.0), wordpiece.data
(&gt;= 1.0.2)</dc:relation>
  <dc:relation>Suggests: covr, knitr, rmarkdown, testthat (&gt;= 3.0.0)</dc:relation>
  <dc:creator>Jonathan Bratt &lt;jonathan.bratt@macmillan.com&gt;</dc:creator>
  <dc:publisher>Comprehensive R Archive Network (CRAN)</dc:publisher>
  <dc:contributor>Jonathan Bratt [aut, cre] (ORCID:
    &lt;https://orcid.org/0000-0003-2859-0076&gt;),
  Jon Harmon [aut] (ORCID: &lt;https://orcid.org/0000-0003-4781-4346&gt;),
  Bedford Freeman &amp; Worth Pub Grp LLC DBA Macmillan Learning [cph]</dc:contributor>
  <dc:rights>Apache License (&gt;= 2)</dc:rights>
  <dc:date>2022-03-03</dc:date>
  <dc:format>application/tgz</dc:format>
  <dc:identifier>https://CRAN.R-project.org/package=wordpiece</dc:identifier>
  <dc:identifier>doi:10.32614/CRAN.package.wordpiece</dc:identifier>
</oai_dc:dc>
