下载:绪论
JAVA_HOME: C:\Program Files\Java\jdk-17.0.20.1 CLASSPATH: %JAVA_HOME%\lib\tools.jar;%JAVA_HOME%\lib\dt.jar; PATH: %JAVA_HOME%\bin;%JAVA_HOME%\jre\bin;
> java > javac
> mvn -v
<localRepository>D:/dev/maven/repo</localRepository>
<project xmlns="http://maven.apache.org/POM/4.0.0" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xsi:schemaLocation="http://maven.apache.org/POM/4.0.0 http://maven.apache.org/xsd/maven-4.0.0.xsd"> <modelVersion>4.0.0</modelVersion> <groupId>cn.edu.bjut.textmining</groupId> <artifactId>JavaTextMining</artifactId> <version>0.0.1-SNAPSHOT</version> <packaging>jar</packaging> <name>textming</name> <url>http://maven.apache.org</url> <properties> <maven.compiler.source>17</maven.compiler.source> <maven.compiler.target>17</maven.compiler.target> <project.build.sourceEncoding>UTF-8</project.build.sourceEncoding> </properties> <dependencies> <dependency> <groupId>junit</groupId> <artifactId>junit</artifactId> <version>3.8.1</version> <scope>test</scope> </dependency> <dependency> <groupId>org.slf4j</groupId> <artifactId>slf4j-simple</artifactId> <version>2.0.18</version> </dependency> <dependency> <groupId>org.apache.opennlp</groupId> <artifactId>opennlp-tools</artifactId> <version>2.3.0</version> </dependency> <dependency> <groupId>org.apache.commons</groupId> <artifactId>commons-lang3</artifactId> <version>3.12.0</version> </dependency> <dependency> <groupId>commons-io</groupId> <artifactId>commons-io</artifactId> <version>2.11.0</version> </dependency> <dependency> <groupId>org.jsoup</groupId> <artifactId>jsoup</artifactId> <version>1.22.2</version> </dependency> <dependency> <groupId>org.apache.lucene</groupId> <artifactId>lucene-core</artifactId> <version>8.11.2</version> </dependency> <dependency> <groupId>org.apache.lucene</groupId> <artifactId>lucene-analyzers-common</artifactId> <version>8.11.2</version> </dependency> </dependencies> </project>
package cn.edu.bjut.textmining.chapter1; import opennlp.tools.tokenize.SimpleTokenizer; public class TokenizerExample { public static void main(String[] args) { String text = "Text analysis and text mining are amazing!"; SimpleTokenizer tokenizer = SimpleTokenizer.INSTANCE; System.out.println("Tokens:"); String[] tokens = tokenizer.tokenize(text); for (String token : tokens) { System.out.println(token); } } }
评论