LIMA
Libre Multilingual Analyzer — C++ API
Loading...
Searching...
No Matches
CharChartTest-ara.cpp
Go to the documentation of this file.
1
// Copyright 2002-2013 CEA LIST
2
// SPDX-FileCopyrightText: 2022 CEA LIST <gael.de-chalendar@cea.fr>
3
//
4
// SPDX-License-Identifier: MIT
5
6
// clazy:skip
7
8
#define BOOST_TEST_DYN_LINK
9
#define BOOST_TEST_MODULE LimaStringTest
10
#include <boost/test/unit_test.hpp>
11
12
#include "
linguisticProcessing/core/FlatTokenizer/CharChart.h
"
13
#include "
common/Data/strwstrtools.h
"
14
#include "
common/QsLog/QsLog.h
"
15
#include "
common/QsLog/QsLogDest.h
"
16
#include "
common/QsLog/QsLogCategories.h
"
17
#include "
common/QsLog/QsDebugOutput.h
"
18
19
using namespace
Lima
;
20
using namespace
Lima::LinguisticProcessing::FlatTokenizer
;
21
22
// unmarking of consonant character is itself
23
BOOST_AUTO_TEST_CASE
( CharChartTestAra_0 )
24
{
25
QsLogging::initQsLog
();
26
CharChart
cc;
27
BOOST_REQUIRE( cc.
loadFromFile
(
"testcharchart-ara.chars.tok"
) );
28
BOOST_REQUIRE_MESSAGE( cc.
unmark
(LimaString::fromUtf8(
"ن"
)[0]) == LimaString::fromUtf8(
"ن"
)[0], (std::string(
"unmark(ن) Got "
) +
LimaString
(cc.
unmark
(LimaString::fromUtf8(
"ن"
)[0])).toUtf8().data() +
" instead of ن"
).c_str() );
29
}
30
31
// // unmarking of accented lowercase character
32
// BOOST_AUTO_TEST_CASE( CharChartTestAra_1 )
33
// {
34
// CharChart cc;
35
// BOOST_REQUIRE( cc.loadFromFile("testcharchart.chars.tok") );
36
// BOOST_REQUIRE( cc.unmark(LimaString::fromUtf8("é")[0]) == LimaString::fromUtf8("e")[0] );
37
// }
38
//
39
// // unmarking of uppercase character
40
// BOOST_AUTO_TEST_CASE( CharChartTestAra_2 )
41
// {
42
// CharChart cc;
43
// BOOST_REQUIRE( cc.loadFromFile("testcharchart.chars.tok") );
44
// BOOST_REQUIRE( cc.unmark(LimaString::fromUtf8("A")[0]) == LimaString::fromUtf8("a")[0] );
45
// }
46
//
47
// // unmarking of accented uppercase character is the unaccented lowercase one
48
// BOOST_AUTO_TEST_CASE( CharChartTestAra_3 )
49
// {
50
// CharChart cc;
51
// BOOST_REQUIRE( cc.loadFromFile("testcharchart.chars.tok") );
52
// BOOST_REQUIRE( cc.unmark(LimaString::fromUtf8("É")[0]) == LimaString::fromUtf8("e")[0] );
53
// }
54
//
55
// // unmarking of non-letter char is null
56
// BOOST_AUTO_TEST_CASE( CharChartTestAra_4 )
57
// {
58
// CharChart cc;
59
// BOOST_REQUIRE( cc.loadFromFile("testcharchart.chars.tok") );
60
// BOOST_REQUIRE( cc.unmark(LimaString::fromUtf8(".")[0]) == LimaChar() );
61
// }
62
//
63
// // unmarking of acronym
64
// BOOST_AUTO_TEST_CASE( CharChartTestAra_5 )
65
// {
66
// CharChart cc;
67
// BOOST_REQUIRE( cc.loadFromFile("testcharchart.chars.tok") );
68
// BOOST_REQUIRE_MESSAGE( cc.unmark(LimaString::fromUtf8("A.A.")) == LimaString::fromUtf8("aa"), (std::string("unmark(A.A.) Got ") + cc.unmark(LimaString::fromUtf8("A.A.")).toUtf8().data() + " instead of aa").c_str() );
69
// }
BOOST_AUTO_TEST_CASE
BOOST_AUTO_TEST_CASE(CharChartTestAra_0)
Definition
CharChartTest-ara.cpp:23
CharChart.h
QsDebugOutput.h
QsLogCategories.h
QsLogDest.h
QsLog.h
Lima::LinguisticProcessing::FlatTokenizer::CharChart
Definition
CharChart.h:32
Lima::LinguisticProcessing::FlatTokenizer::CharChart::unmark
Lima::LimaChar unmark(const Lima::LimaChar &c) const
Gets the unmark character corresponding to the specified character.
Definition
CharChart.cpp:227
Lima::LinguisticProcessing::FlatTokenizer::CharChart::loadFromFile
bool loadFromFile(const std::string &fileName)
Definition
CharChart.cpp:380
Lima::LinguisticProcessing::FlatTokenizer
Definition
deaccentuatedTransition.h:29
Lima
NAUTITIA.
Definition
AmosePluginsManager.h:15
Lima::LimaString
QString LimaString
Definition
LimaString.h:33
QsLogging::initQsLog
LIMA_COMMONQSLOG_EXPORT bool initQsLog(const QString &configString)
Definition
QsLogCategories.cpp:193
strwstrtools.h
lima_linguisticprocessing
src
linguisticProcessing
core
FlatTokenizer
Tests
CharChartTest-ara.cpp
Generated by
1.9.8