LIMA
Libre Multilingual Analyzer — C++ API
Loading...
Searching...
No Matches
CharChartTest0.cpp
Go to the documentation of this file.
1
// Copyright 2002-2013 CEA LIST
2
// SPDX-FileCopyrightText: 2022 CEA LIST <gael.de-chalendar@cea.fr>
3
//
4
// SPDX-License-Identifier: MIT
5
6
// clazy:skip
7
8
#define BOOST_TEST_DYN_LINK
9
#define BOOST_TEST_MODULE LimaStringTest
10
#include <boost/test/unit_test.hpp>
11
12
#include "
linguisticProcessing/core/FlatTokenizer/CharChart.h
"
13
#include "
common/Data/strwstrtools.h
"
14
15
using namespace
Lima
;
16
using namespace
Lima::LinguisticProcessing::FlatTokenizer
;
17
18
// loading test char chart
19
BOOST_AUTO_TEST_CASE
( CharChartTest0_00 )
20
{
21
CharChart
cc;
22
BOOST_REQUIRE( cc.
loadFromFile
(
"testcharchart.chars.tok"
) );
23
}
24
25
// unmarking of non-accented lowercase character is itself
26
BOOST_AUTO_TEST_CASE
( CharChartTest0_0 )
27
{
28
CharChart
cc;
29
BOOST_REQUIRE( cc.
loadFromFile
(
"testcharchart.chars.tok"
) );
30
BOOST_REQUIRE_MESSAGE( cc.
unmark
(LimaString::fromUtf8(
"e"
)[0]) == LimaString::fromUtf8(
"e"
)[0], (std::string(
"unmark(e) Got "
) +
LimaString
(cc.
unmark
(LimaString::fromUtf8(
"e"
)[0])).toUtf8().data() +
" instead of e"
).c_str() );
31
}
32
33
// unmarking of accented lowercase character
34
BOOST_AUTO_TEST_CASE
( CharChartTest0_1 )
35
{
36
CharChart
cc;
37
BOOST_REQUIRE( cc.
loadFromFile
(
"testcharchart.chars.tok"
) );
38
BOOST_REQUIRE( cc.
unmark
(LimaString::fromUtf8(
"é"
)[0]) == LimaString::fromUtf8(
"e"
)[0] );
39
}
40
41
// unmarking of uppercase character
42
BOOST_AUTO_TEST_CASE
( CharChartTest0_2 )
43
{
44
CharChart
cc;
45
BOOST_REQUIRE( cc.
loadFromFile
(
"testcharchart.chars.tok"
) );
46
BOOST_REQUIRE( cc.
unmark
(LimaString::fromUtf8(
"A"
)[0]) == LimaString::fromUtf8(
"a"
)[0] );
47
}
48
49
// unmarking of accented uppercase character is the unaccented lowercase one
50
BOOST_AUTO_TEST_CASE
( CharChartTest0_3 )
51
{
52
CharChart
cc;
53
BOOST_REQUIRE( cc.
loadFromFile
(
"testcharchart.chars.tok"
) );
54
BOOST_REQUIRE( cc.
unmark
(LimaString::fromUtf8(
"É"
)[0]) == LimaString::fromUtf8(
"e"
)[0] );
55
}
56
57
// unmarking of non-letter char is null
58
BOOST_AUTO_TEST_CASE
( CharChartTest0_4 )
59
{
60
CharChart
cc;
61
BOOST_REQUIRE( cc.
loadFromFile
(
"testcharchart.chars.tok"
) );
62
BOOST_REQUIRE( cc.
unmark
(LimaString::fromUtf8(
"."
)[0]) ==
LimaChar
() );
63
}
64
65
// unmarking of acronym
66
BOOST_AUTO_TEST_CASE
( CharChartTest0_5 )
67
{
68
CharChart
cc;
69
BOOST_REQUIRE( cc.
loadFromFile
(
"testcharchart.chars.tok"
) );
70
BOOST_REQUIRE_MESSAGE( cc.
unmark
(LimaString::fromUtf8(
"A.A."
)) == LimaString::fromUtf8(
"aa"
), (std::string(
"unmark(A.A.) Got "
) + cc.
unmark
(LimaString::fromUtf8(
"A.A."
)).toUtf8().data() +
" instead of aa"
).c_str() );
71
}
BOOST_AUTO_TEST_CASE
BOOST_AUTO_TEST_CASE(CharChartTest0_00)
Definition
CharChartTest0.cpp:19
CharChart.h
Lima::LinguisticProcessing::FlatTokenizer::CharChart
Definition
CharChart.h:32
Lima::LinguisticProcessing::FlatTokenizer::CharChart::unmark
Lima::LimaChar unmark(const Lima::LimaChar &c) const
Gets the unmark character corresponding to the specified character.
Definition
CharChart.cpp:227
Lima::LinguisticProcessing::FlatTokenizer::CharChart::loadFromFile
bool loadFromFile(const std::string &fileName)
Definition
CharChart.cpp:380
Lima::LinguisticProcessing::FlatTokenizer
Definition
deaccentuatedTransition.h:29
Lima
NAUTITIA.
Definition
AmosePluginsManager.h:15
Lima::LimaChar
QChar LimaChar
Definition
LimaString.h:30
Lima::LimaString
QString LimaString
Definition
LimaString.h:33
strwstrtools.h
lima_linguisticprocessing
src
linguisticProcessing
core
FlatTokenizer
Tests
CharChartTest0.cpp
Generated by
1.9.8