Skip to content

Commit 8bcddf9

Browse files
committed
OPENNLP-1886: Align null contracts, annotations, and dev helper placement with the review conventions
1 parent 6edbae5 commit 8bcddf9

14 files changed

Lines changed: 224 additions & 214 deletions

opennlp-core/opennlp-runtime/src/main/java/opennlp/tools/stemmer/light/FinnishLightStemmer.java

Lines changed: 3 additions & 3 deletions
Original file line numberDiff line numberDiff line change
@@ -89,11 +89,11 @@ int stem(char[] s, int len) {
8989

9090
for (int i = 0; i < len; i++)
9191
switch (s[i]) {
92-
case 'ä':
93-
case 'å':
92+
case '\u00E4':
93+
case '\u00E5':
9494
s[i] = 'a';
9595
break;
96-
case 'ö':
96+
case '\u00F6':
9797
s[i] = 'o';
9898
break;
9999
}

opennlp-core/opennlp-runtime/src/main/java/opennlp/tools/stemmer/light/FrenchLightStemmer.java

Lines changed: 14 additions & 14 deletions
Original file line numberDiff line numberDiff line change
@@ -167,7 +167,7 @@ int stem(char[] s, int len) {
167167
s[len - 1] = 'r';
168168
}
169169

170-
if (len > 5 && endsWith(s, len, "ième")) return norm(s, len - 4);
170+
if (len > 5 && endsWith(s, len, "i\u00E8me")) return norm(s, len - 4);
171171

172172
if (len > 7 && endsWith(s, len, "teuse")) {
173173
len -= 2;
@@ -183,7 +183,7 @@ int stem(char[] s, int len) {
183183

184184
if (len > 5 && endsWith(s, len, "euse")) return norm(s, len - 2);
185185

186-
if (len > 8 && endsWith(s, len, "ère")) {
186+
if (len > 8 && endsWith(s, len, "\u00E8re")) {
187187
len--;
188188
s[len - 2] = 'e';
189189
return norm(s, len);
@@ -205,7 +205,7 @@ int stem(char[] s, int len) {
205205

206206
if (len > 9 && endsWith(s, len, "nnel")) return norm(s, len - 3);
207207

208-
if (len > 4 && endsWith(s, len, "ète")) {
208+
if (len > 4 && endsWith(s, len, "\u00E8te")) {
209209
len--;
210210
s[len - 2] = 'e';
211211
}
@@ -235,27 +235,27 @@ private int norm(char[] s, int len) {
235235
if (len > 4) {
236236
for (int i = 0; i < len; i++)
237237
switch (s[i]) {
238-
case 'à':
239-
case 'á':
240-
case 'â':
238+
case '\u00E0':
239+
case '\u00E1':
240+
case '\u00E2':
241241
s[i] = 'a';
242242
break;
243-
case 'ô':
243+
case '\u00F4':
244244
s[i] = 'o';
245245
break;
246-
case 'è':
247-
case 'é':
248-
case 'ê':
246+
case '\u00E8':
247+
case '\u00E9':
248+
case '\u00EA':
249249
s[i] = 'e';
250250
break;
251-
case 'ù':
252-
case 'û':
251+
case '\u00F9':
252+
case '\u00FB':
253253
s[i] = 'u';
254254
break;
255-
case 'î':
255+
case '\u00EE':
256256
s[i] = 'i';
257257
break;
258-
case 'ç':
258+
case '\u00E7':
259259
s[i] = 'c';
260260
break;
261261
}

opennlp-core/opennlp-runtime/src/main/java/opennlp/tools/stemmer/light/FrenchMinimalStemmer.java

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -90,7 +90,7 @@ int stem(char[] s, int len) {
9090
if (s[len - 1] == 's') len--;
9191
if (s[len - 1] == 'r') len--;
9292
if (s[len - 1] == 'e') len--;
93-
if (s[len - 1] == 'é') len--;
93+
if (s[len - 1] == '\u00E9') len--;
9494
// Character.isLetter is intentional: it is the letter test of the ported algorithm.
9595
if (s[len - 1] == s[len - 2] && Character.isLetter(s[len - 1])) len--;
9696
return len;

opennlp-core/opennlp-runtime/src/main/java/opennlp/tools/stemmer/light/GermanLightStemmer.java

Lines changed: 16 additions & 16 deletions
Original file line numberDiff line numberDiff line change
@@ -81,28 +81,28 @@ public Stemmer newStemmer() {
8181
int stem(char[] s, int len) {
8282
for (int i = 0; i < len; i++)
8383
switch (s[i]) {
84-
case 'ä':
85-
case 'à':
86-
case 'á':
87-
case 'â':
84+
case '\u00E4':
85+
case '\u00E0':
86+
case '\u00E1':
87+
case '\u00E2':
8888
s[i] = 'a';
8989
break;
90-
case 'ö':
91-
case 'ò':
92-
case 'ó':
93-
case 'ô':
90+
case '\u00F6':
91+
case '\u00F2':
92+
case '\u00F3':
93+
case '\u00F4':
9494
s[i] = 'o';
9595
break;
96-
case 'ï':
97-
case 'ì':
98-
case 'í':
99-
case 'î':
96+
case '\u00EF':
97+
case '\u00EC':
98+
case '\u00ED':
99+
case '\u00EE':
100100
s[i] = 'i';
101101
break;
102-
case 'ü':
103-
case 'ù':
104-
case 'ú':
105-
case 'û':
102+
case '\u00FC':
103+
case '\u00F9':
104+
case '\u00FA':
105+
case '\u00FB':
106106
s[i] = 'u';
107107
break;
108108
}

opennlp-core/opennlp-runtime/src/main/java/opennlp/tools/stemmer/light/GermanMinimalStemmer.java

Lines changed: 3 additions & 3 deletions
Original file line numberDiff line numberDiff line change
@@ -83,13 +83,13 @@ int stem(char[] s, int len) {
8383

8484
for (int i = 0; i < len; i++)
8585
switch (s[i]) {
86-
case 'ä':
86+
case '\u00E4':
8787
s[i] = 'a';
8888
break;
89-
case 'ö':
89+
case '\u00F6':
9090
s[i] = 'o';
9191
break;
92-
case 'ü':
92+
case '\u00FC':
9393
s[i] = 'u';
9494
break;
9595
}

opennlp-core/opennlp-runtime/src/main/java/opennlp/tools/stemmer/light/HungarianLightStemmer.java

Lines changed: 13 additions & 13 deletions
Original file line numberDiff line numberDiff line change
@@ -86,27 +86,27 @@ public Stemmer newStemmer() {
8686
int stem(char[] s, int len) {
8787
for (int i = 0; i < len; i++)
8888
switch (s[i]) {
89-
case 'á':
89+
case '\u00E1':
9090
s[i] = 'a';
9191
break;
92-
case 'ë':
93-
case 'é':
92+
case '\u00EB':
93+
case '\u00E9':
9494
s[i] = 'e';
9595
break;
96-
case 'í':
96+
case '\u00ED':
9797
s[i] = 'i';
9898
break;
99-
case 'ó':
100-
case 'ő':
101-
case 'õ':
102-
case 'ö':
99+
case '\u00F3':
100+
case '\u0151':
101+
case '\u00F5':
102+
case '\u00F6':
103103
s[i] = 'o';
104104
break;
105-
case 'ú':
106-
case 'ű':
107-
case 'ũ':
108-
case 'û':
109-
case 'ü':
105+
case '\u00FA':
106+
case '\u0171':
107+
case '\u0169':
108+
case '\u00FB':
109+
case '\u00FC':
110110
s[i] = 'u';
111111
break;
112112
}

opennlp-core/opennlp-runtime/src/main/java/opennlp/tools/stemmer/light/ItalianLightStemmer.java

Lines changed: 20 additions & 20 deletions
Original file line numberDiff line numberDiff line change
@@ -83,34 +83,34 @@ int stem(char[] s, int len) {
8383

8484
for (int i = 0; i < len; i++)
8585
switch (s[i]) {
86-
case 'à':
87-
case 'á':
88-
case 'â':
89-
case 'ä':
86+
case '\u00E0':
87+
case '\u00E1':
88+
case '\u00E2':
89+
case '\u00E4':
9090
s[i] = 'a';
9191
break;
92-
case 'ò':
93-
case 'ó':
94-
case 'ô':
95-
case 'ö':
92+
case '\u00F2':
93+
case '\u00F3':
94+
case '\u00F4':
95+
case '\u00F6':
9696
s[i] = 'o';
9797
break;
98-
case 'è':
99-
case 'é':
100-
case 'ê':
101-
case 'ë':
98+
case '\u00E8':
99+
case '\u00E9':
100+
case '\u00EA':
101+
case '\u00EB':
102102
s[i] = 'e';
103103
break;
104-
case 'ù':
105-
case 'ú':
106-
case 'û':
107-
case 'ü':
104+
case '\u00F9':
105+
case '\u00FA':
106+
case '\u00FB':
107+
case '\u00FC':
108108
s[i] = 'u';
109109
break;
110-
case 'ì':
111-
case 'í':
112-
case 'î':
113-
case 'ï':
110+
case '\u00EC':
111+
case '\u00ED':
112+
case '\u00EE':
113+
case '\u00EF':
114114
s[i] = 'i';
115115
break;
116116
}

opennlp-core/opennlp-runtime/src/main/java/opennlp/tools/stemmer/light/NorwegianLightStemmer.java

Lines changed: 11 additions & 7 deletions
Original file line numberDiff line numberDiff line change
@@ -81,17 +81,21 @@ public final class NorwegianLightStemmer extends AbstractCharArrayStemmer
8181
*
8282
* @param first The first standard whose endings are removed; must not be null.
8383
* @param more Further standards; must not be or contain null.
84-
* @throws IllegalArgumentException Thrown if a variety is null.
84+
* @throws IllegalArgumentException Thrown if {@code first} or {@code more} is null,
85+
* or {@code more} contains null.
8586
*/
8687
public NorwegianLightStemmer(NorwegianVariety first, NorwegianVariety... more) {
87-
if (first == null || more == null) {
88-
throw new IllegalArgumentException("The variety must not be null.");
88+
if (first == null) {
89+
throw new IllegalArgumentException("first must not be null");
90+
}
91+
if (more == null) {
92+
throw new IllegalArgumentException("more must not be null");
8993
}
9094
boolean bokmaal = first == NorwegianVariety.BOKMAAL;
9195
boolean nynorsk = first == NorwegianVariety.NYNORSK;
9296
for (final NorwegianVariety variety : more) {
9397
if (variety == null) {
94-
throw new IllegalArgumentException("The variety must not be null.");
98+
throw new IllegalArgumentException("more must not contain null");
9599
}
96100
bokmaal |= variety == NorwegianVariety.BOKMAAL;
97101
nynorsk |= variety == NorwegianVariety.NYNORSK;
@@ -149,8 +153,8 @@ int stem(char[] s, int len) {
149153

150154
if (len > 7
151155
&& (endsWith(s, len, "elser")
152-
|| // general ending (føl-elser -> føl)
153-
endsWith(s, len, "elsen"))) // general ending (føl-elsen -> føl)
156+
|| // general ending (f\u00F8l-elser -> f\u00F8l)
157+
endsWith(s, len, "elsen"))) // general ending (f\u00F8l-elsen -> f\u00F8l)
154158
return len - 5;
155159

156160
if (len > 6
@@ -159,7 +163,7 @@ int stem(char[] s, int len) {
159163
(endsWith(s, len, "ande") && useNynorsk)
160164
|| // (sov-ande -> sov)
161165
endsWith(s, len, "else")
162-
|| // general ending (føl-else -> føl)
166+
|| // general ending (f\u00F8l-else -> f\u00F8l)
163167
(endsWith(s, len, "este") && useBokmaal)
164168
|| // adj (fin-este -> fin)
165169
(endsWith(s, len, "aste") && useNynorsk)

opennlp-core/opennlp-runtime/src/main/java/opennlp/tools/stemmer/light/NorwegianMinimalStemmer.java

Lines changed: 9 additions & 5 deletions
Original file line numberDiff line numberDiff line change
@@ -58,7 +58,7 @@
5858
import static opennlp.tools.stemmer.light.StemmerUtil.endsWith;
5959

6060
/**
61-
* Minimal Stemmer for Norwegian Bokmål ({@code nb}) and Nynorsk ({@code nn}).
61+
* Minimal Stemmer for Norwegian Bokm\u00E5l ({@code nb}) and Nynorsk ({@code nn}).
6262
*
6363
* <p>Stems known plural forms for Norwegian nouns only, together with the genitive {@code -s}.
6464
*
@@ -79,17 +79,21 @@ public final class NorwegianMinimalStemmer extends AbstractCharArrayStemmer
7979
*
8080
* @param first The first standard whose endings are removed; must not be null.
8181
* @param more Further standards; must not be or contain null.
82-
* @throws IllegalArgumentException Thrown if a variety is null.
82+
* @throws IllegalArgumentException Thrown if {@code first} or {@code more} is null,
83+
* or {@code more} contains null.
8384
*/
8485
public NorwegianMinimalStemmer(NorwegianVariety first, NorwegianVariety... more) {
85-
if (first == null || more == null) {
86-
throw new IllegalArgumentException("The variety must not be null.");
86+
if (first == null) {
87+
throw new IllegalArgumentException("first must not be null");
88+
}
89+
if (more == null) {
90+
throw new IllegalArgumentException("more must not be null");
8791
}
8892
boolean bokmaal = first == NorwegianVariety.BOKMAAL;
8993
boolean nynorsk = first == NorwegianVariety.NYNORSK;
9094
for (final NorwegianVariety variety : more) {
9195
if (variety == null) {
92-
throw new IllegalArgumentException("The variety must not be null.");
96+
throw new IllegalArgumentException("more must not contain null");
9397
}
9498
bokmaal |= variety == NorwegianVariety.BOKMAAL;
9599
nynorsk |= variety == NorwegianVariety.NYNORSK;

0 commit comments

Comments
 (0)