Pinyin4j是一个流行的Java库,支持中文字符和拼音之间的转换。拼音输出格式可以定制。

Support Chinese character (both Simplified and Tranditional) to most popular Pinyin systems, including Hanyu Pinyin, Tongyong Pinyin, Wade-Giles, MPS2, Yale and Gwoyeu Romatzyh. Support multiple pronounciations and customized output.

pinyin4j是一个支持将中文转换到拼音的Java开源类库。

POM引入:

<dependency>
<groupId>net.sourceforge.pinyin4j</groupId>
<artifactId>pinyin4j</artifactId>
<version>2.5.0</version>
</dependency>

项目地址:

https://sourceforge.net/projects/pinyin4j/

实用示例,如果一个汉字是多音字,那么将采取组装所有可能的组合:

package com.javacui.lucene.pinyin;
import java.util.HashSet;
import java.util.Set;
import com.alibaba.fastjson.JSON;
import net.sourceforge.pinyin4j.PinyinHelper;
import net.sourceforge.pinyin4j.format.HanyuPinyinCaseType;
import net.sourceforge.pinyin4j.format.HanyuPinyinOutputFormat;
import net.sourceforge.pinyin4j.format.HanyuPinyinToneType;
import net.sourceforge.pinyin4j.format.HanyuPinyinVCharType;
import net.sourceforge.pinyin4j.format.exception.BadHanyuPinyinOutputFormatCombination;
/**
* 打印中文拼音的所有组合
*/
public class Pinyin4j {
public static void main(String[] args) {
String cnStr = "长沙市重庆市";
System.out.println(makePinyin(cnStr));
}
/**
* 字符串凑集转换字符串(逗号分隔)
*/
public static String makeStringByStringSet(Set<String> stringSet) {
StringBuilder str = new StringBuilder();
int i = 0;
for (String s : stringSet) {
if (i == stringSet.size() - 1) {
str.append(s);
} else {
str.append(s + ",");
}
i++;
}
return str.toString().toLowerCase();
}
/**
* 获取拼音凑集
*/
public static Set<String> getPinyin(String src) {
if (src != null && !src.trim().equalsIgnoreCase("")) {
char[] srcChar;
srcChar = src.toCharArray();
// 汉语拼音格局输出类
HanyuPinyinOutputFormat hanYuPinOutputFormat = new HanyuPinyinOutputFormat();
// 输出设置,大小写,音标体式格式等
hanYuPinOutputFormat.setCaseType(HanyuPinyinCaseType.LOWERCASE);
// HanyuPinyinToneType.WITH_TONE_NUMBER 用数字表示声调,例如:liu2
// HanyuPinyinToneType.WITHOUT_TONE 无声调表示,例如:liu
// HanyuPinyinToneType.WITH_TONE_MARK 用声调符号表示,例如:liú
hanYuPinOutputFormat.setToneType(HanyuPinyinToneType.WITHOUT_TONE);
hanYuPinOutputFormat.setVCharType(HanyuPinyinVCharType.WITH_V);
String[][] temp = new String[src.length()][];
for (int i = 0; i < srcChar.length; i++) {
char c = srcChar[i];
// 是中文或者a-z或者A-Z转换拼音(根据需求来)
if (String.valueOf(c).matches("[\\u4E00-\\u9FA5]+")) {
try {
temp[i] = PinyinHelper.toHanyuPinyinStringArray(srcChar[i], hanYuPinOutputFormat);
} catch (BadHanyuPinyinOutputFormatCombination e) {
e.printStackTrace();
}
} else if (((int) c >= 65 && (int) c <= 90) || ((int) c >= 97 && (int) c <= 122)) {
temp[i] = new String[] { String.valueOf(srcChar[i]) };
} else {
temp[i] = new String[] { "" };
}
}
System.out.println("中文单词分解:"+JSON.toJSONString(temp));
String[] pingyinArray = Exchange(temp);
Set<String> pinyinSet = new HashSet<String>();
for (int i = 0; i < pingyinArray.length; i++) {
pinyinSet.add(pingyinArray[i]);
}
return pinyinSet;
}
return null;
}
/**
* 递归
*/
public static String[] Exchange(String[][] strJaggedArray) {
String[][] temp = DoExchange(strJaggedArray);
return temp[0];
}
/**
* 递归
*/
private static String[][] DoExchange(String[][] strJaggedArray) {
int len = strJaggedArray.length;
if (len >= 2) {
int len1 = strJaggedArray[0].length;
int len2 = strJaggedArray[1].length;
int newlen = len1 * len2;
String[] temp = new String[newlen];
int Index = 0;
for (int i = 0; i < len1; i++) {
for (int j = 0; j < len2; j++) {
temp[Index] = strJaggedArray[0][i] + strJaggedArray[1][j];
Index++;
}
}
String[][] newArray = new String[len - 1][];
for (int i = 2; i < len; i++) {
newArray[i - 1] = strJaggedArray[i];
}
newArray[0] = temp;
return DoExchange(newArray);
} else {
return strJaggedArray;
}
}
public static String makePinyin(String str){
Set<String> set = getPinyin(str);
System.out.println("中文单词组合:"+JSON.toJSONString(set));
return makeStringByStringSet(set);
}
}

最新文章

  1. JavaScript DOM编程艺术读书笔记(三)
  2. [CareerCup] 18.4 Count Number of Two 统计数字2的个数
  3. c#中各类日期的计算方法,收藏
  4. 【niubi-job——一个分布式的任务调度框架】----niubi-job这下更牛逼了!
  5. Python——内置类型
  6. 聚焦 SQL 数据库活动异地复制
  7. WebService笔记-Schema约束
  8. 你需要知道的九大排序算法【Python实现】之冒泡排序
  9. Android 开发佳站【转】
  10. sql分隔字符串数组
  11. 在java代码中获取JVM参数(转)
  12. 顺序线性表之大整数求和C++
  13. CentOS 6.5 Web服务器搭建
  14. 【Linux】CentOS7下安装JDK详细过程
  15. HTML和CSS总结
  16. FFmpeg: AVCodecParameters 结构体分析
  17. jquery删除onclick属性和设置onclick属性--获取验证码
  18. 关于Django的序列化
  19. MS SQL Server 定时任务实现自动备份
  20. BUG克星:几款优秀的BUG跟踪管理软件

热门文章

  1. LeetCode 260. 只出现一次的数字 III(Single Number III)
  2. 剑指offer-字符串的排列
  3. maven 安装后变成 mvn 不是内部命令解决方法
  4. java线程锁之synchronized
  5. SOAP1.1&amp;SOAP1.2
  6. centOS 开启端口
  7. URL encoding(URL编码)
  8. linux常用、常见错误
  9. java数据结构之ArrayList
  10. Smarty快速入门