`

Java字符串分隔方法split实践

阅读更多

        在工作中,有字符串分隔很自然也一直用String的split方法,但直到今天,我竟然踩到了一个坑。

一.正常的分隔,分隔符是“:”

package com.bijian.test;

import java.util.List;

import com.google.common.base.Splitter;

public class SplitTest {
    
    private static final String SPLIT_CHAR = ":";
    
    public static void main(String[] args) {
        String str = "21001:03";
        splitMethod1(str);
        splitMethod2(str);
    }

    private static void splitMethod1(String str) {
        String[] strList = str.split(SPLIT_CHAR);
        String firstStr = strList[0];
        String secondStr = strList[1];
        System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
    }
    
    private static void splitMethod2(String str) {
        List<String> strList = Splitter.on(SPLIT_CHAR).splitToList(str);
        String firstStr = strList.get(0);
        String secondStr = strList.get(1);
        System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
    }
}

运行结果:

firstStr:21001,secondStr:03
firstStr:21001,secondStr:03

 

二.复杂的分隔,分隔符是“:@:”

package com.bijian.test;

import java.util.List;

import com.google.common.base.Splitter;

public class SplitTest {
    
    private static final String SPLIT_CHAR = ":@:";
    
    public static void main(String[] args) {
        String str = "21001:@:03";
        splitMethod1(str);
        splitMethod2(str);
    }

    private static void splitMethod1(String str) {
        String[] strList = str.split(SPLIT_CHAR);
        String firstStr = strList[0];
        String secondStr = strList[1];
        System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
    }
    
    private static void splitMethod2(String str) {
        List<String> strList = Splitter.on(SPLIT_CHAR).splitToList(str);
        String firstStr = strList.get(0);
        String secondStr = strList.get(1);
        System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
    }
}

运行结果:

firstStr:21001,secondStr:03
firstStr:21001,secondStr:03

 

三.将实例二中的@换成|,即分隔符为“:|:”

package com.bijian.test;

import java.util.List;

import com.google.common.base.Splitter;

public class SplitTest {
    
    private static final String SPLIT_CHAR = ":|:";
    
    public static void main(String[] args) {
        String str = "21001:|:03";
        splitMethod1(str);
        splitMethod2(str);
    }

    private static void splitMethod1(String str) {
        String[] strList = str.split(SPLIT_CHAR);
        String firstStr = strList[0];
        String secondStr = strList[1];
        System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
    }
    
    private static void splitMethod2(String str) {
        List<String> strList = Splitter.on(SPLIT_CHAR).splitToList(str);
        String firstStr = strList.get(0);
        String secondStr = strList.get(1);
        System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
    }
}

运行结果:

firstStr:21001,secondStr:|
firstStr:21001,secondStr:03

 

四.原来是“|”的问题,分隔符仅为“|”测试运行如下

package com.bijian.test;

import java.util.List;

import com.google.common.base.Splitter;

public class SplitTest {
    
    private static final String SPLIT_CHAR = "|";
    
    public static void main(String[] args) {
        String str = "21001|03";
        splitMethod1(str);
        splitMethod2(str);
    }

    private static void splitMethod1(String str) {
        String[] strList = str.split(SPLIT_CHAR);
        String firstStr = strList[0];
        String secondStr = strList[1];
        System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
    }
    
    private static void splitMethod2(String str) {
        List<String> strList = Splitter.on(SPLIT_CHAR).splitToList(str);
        String firstStr = strList.get(0);
        String secondStr = strList.get(1);
        System.out.println("firstStr:" + firstStr + ",secondStr:" + secondStr);
    }
}

运行结果:

firstStr:,secondStr:2
firstStr:21001,secondStr:03

 

五.案例分析

        使用String.split方法分隔字符串时,分隔符如果用到一些特殊字符,可能会得不到我们预期的结果。

        我们看jdk doc中说明

public String[] split(String regex)
 Splits this string around matches of the given regular expression.

        参数regex是一个 regular-expression的匹配模式而不是一个简单的String,他对一些特殊的字符可能会出现你预想不到的结果,比如测试下面的代码:

        1.用竖线 | 分隔字符串,你将得不到预期的结果

public static void splitTest02() {
        
        String splitChar = "|";  //结果不正确
        //String splitChar = "\\|";
        
        String str = "bijian|bi|jian";
        String[] strs = str.split(splitChar);
        System.out.println(strs[0]);
        System.out.println(strs[1]);
        System.out.println(strs[2]);
}

        2.用竖 * 分隔字符串运行将抛出java.util.regex.PatternSyntaxException异常,用加号 + 也是如此。

public static void splitTest04() {
        
        String[] aa = "aaa*bbb*ccc".split("*"); //Exception in thread "main" java.util.regex.PatternSyntaxException: Dangling meta character '*' near index 0
        //String[] aa = "aaa|bbb|ccc".split("\\*"); 这样才能得到正确的结果   
        for (int i = 0 ; i <aa.length ; i++ ) {
          System.out.println("--"+aa[i]);
        }
}

        显然,+ * 不是有效的模式匹配规则表达式,用"\\*" "\\+"转义后即可得到正确的结果。"|" 分隔串时虽然能够执行,但是却不是预期的目的,"\\|"转义后即可得到正确的结果。

        如果想在串中使用""字符,则也需要转义。首先要表达"aaaa\bbbb"这个串就应该用"aaaa\\bbbb",如果要分隔就应该这样才能得到正确结果:

String[] aa = "aaa\\bbb\\bccc".split("\\\\");

 

六.小结

        1.如果用"."作为分隔的话,必须是如下写法:String.split("\\."),这样才能正确的分隔开,不能用String.split(".");

        2.如果用"|"作为分隔的话,必须是如下写法:String.split("\\|"),这样才能正确的分隔开,不能用String.split("|");

        "."和"|"都是转义字符,必须得加"\";

        但实际上这样还是有坑,String 自带的Split 分割字符串类中不会把分割字符串后的空字符串添加到数组当中,String[] str = "000|111|222||".split("\\|");进行分割后字符串的长度为3,只能得到str[0],str[1],str[2],后面的str[3],str[4]是不存在的,如果直接访问str[3],str[4]会发生以下错误:java.lang.ArrayIndexOutOfBoundsException。

        3.如果在一个字符串中有多个分隔符,可以用"|"作为连字符,比如:"acount=? and uu =? or n=?",把三个都分隔出来,可以用String.split("and|or");

        4.采用com.google.common.base.Splitter的on方法,如上实例所示。【综合考虑,这种方法很OK】

        5.使用org.apache.commons.lang.StringUtils.splitPreserveAllTokens 方法。【综合考虑,这种方法很OK】

        6.使用String.split(str, n);指定分隔的次数。【这个测试是OK的,但在具体使用中,很难知道我要分隔的次数】


 

附:测试实例

package com.bijian.test;

public class SplitTest {

    public static void main(String[] args) {
        splitTest05();
    }
    
    public static void splitTest01() {
        
        //String splitChar = ".";  //结果不正确
        String splitChar = "\\.";
        
        String str = "bijian.bi.jian";
        String[] strs = str.split(splitChar);
        System.out.println(strs[0]);
        System.out.println(strs[1]);
        System.out.println(strs[2]);
    }
    
    public static void splitTest02() {
        
        String splitChar = "|";  //结果不正确
        //String splitChar = "\\|";
        
        String str = "bijian|bi|jian";
        String[] strs = str.split(splitChar);
        System.out.println(strs[0]);
        System.out.println(strs[1]);
        System.out.println(strs[2]);
    }
    
    public static void splitTest03() {
        
        String splitChar = "and|or";
        String str = "acount=? and uu =? or n=?";
        String[] strs = str.split(splitChar);
        System.out.println(strs[0]);
        System.out.println(strs[1]);
        System.out.println(strs[2]);
    }
    
    public static void splitTest04() {
        
        String[] aa = "aaa*bbb*ccc".split("*"); //Exception in thread "main" java.util.regex.PatternSyntaxException: Dangling meta character '*' near index 0
        //String[] aa = "aaa|bbb|ccc".split("\\*"); 这样才能得到正确的结果   
        for (int i = 0 ; i <aa.length ; i++ ) {
          System.out.println("--"+aa[i]);
        }
    }
    
    public static void splitTest05() {
        
        String[] aa = "aaa\\bbb\\bccc".split("\\\\");
        for (int i = 0 ; i <aa.length ; i++ ) {
            System.out.println(aa[i]);
        }
    }
}

 

  • 大小: 45.8 KB
分享到:
评论

相关推荐

    java字符串练习

    总的来说,Java字符串处理涉及的方法很多,包括但不限于`split()`, `substring()`, `indexOf()`, `replace()`, `trim()`等。理解并熟练运用这些方法对于提升Java编程技能非常有帮助。对于初学者而言,通过实践上述...

    JAVA 字符串 操作

    在Java编程语言中,字符串...以上只是Java字符串操作的一小部分,实际开发中还有许多其他方法和特性,如国际化(I18N)、正则表达式等,都需要程序员灵活掌握。理解并熟练运用这些操作,能有效提高代码质量和效率。

    java 字符串分割

    1. 使用 split() 方法:split() 方法可以将字符串按照指定的分隔符分割成数组。例如:`String[] arr = str.split(",");` 2. 使用 substring() 方法:substring() 方法可以将字符串按照指定的起始索引和结束索引分割...

    Java分割字符串

    下面是一个简单的例子,展示了如何使用`split()`方法以空格分隔字符串: ```java String str = "Hello World, How Are You?"; String[] parts = str.split(" "); for (String part : parts) { System.out.println...

    java 分解字符串

    `split()`方法是`String`类的一个实例方法,它接受一个正则表达式作为参数,并根据这个正则表达式将字符串分割成一个字符串数组。例如,如果我们有一个字符串`"Hello, World! How are you?"`,我们可以用逗号分隔它...

    java 字符串操作类

    `split()` 方法是字符串分隔的核心,它通常用于将一个字符串按照特定的分隔符切割成多个子字符串。例如,`split(",")` 可以将逗号分隔的字符串转换为字符串数组。 2. **插入字符串**: `insert()` 方法允许你在...

    java 分割字符串

    下面是一个简单的例子,演示如何使用`split()`方法以空格为分隔符分割字符串: ```java public class StringDemo_11 { public static void main(String[] args) { String str = "Hello Java 分割字符串 示例"; ...

    字符串分隔工具

    在Python中,`str.split()`函数就是一个典型的字符串分隔工具。它接受一个可选参数,即分隔符,默认为空格。例如,字符串"apple,banana,grape"通过`.split(",")`会被拆分为`['apple', 'banana', 'grape']`。如果需要...

    Split-由任意个全角或半角空格分隔开的任意长度的字符串

    "Split"函数或方法在许多编程语言中都有提供,用于将一个长字符串按照特定的分隔符拆分成多个子字符串。在这个场景中,标题提到的是“由任意个全角或半角空格分隔开的任意长度的字符串”,这暗示了我们处理的是包含...

    字符串分割

    在这个例子中,逗号(",")是分隔符,`split(",")`将原始字符串按照逗号切割成了六个子字符串,并将它们存储在列表中。 在Java中,我们使用`String`类的`split()`方法。与Python类似,它也接收一个分隔符作为参数,...

    java 创建字符串类

    - `split()`:根据指定分隔符将字符串拆分为字符数组。 6. **字符串查找与替换**: - `indexOf()`和`lastIndexOf()`:查找子字符串首次出现或最后一次出现的位置。 - `contains()`:检查字符串是否包含指定子...

    Java 字符串操作源码实例集.rar

    这些基本操作是Java字符串处理的核心。通过实践这些实例,初学者可以更好地理解字符串操作的原理和用法,为以后的开发打下坚实基础。在压缩包中找到的"codesc.net"可能是包含这些实例代码的文件,打开并运行这些代码...

    Java 实例 - 字符串分隔(StringTokenizer)源代码-详细教程.zip

    `StringTokenizer`提供了几个重要的方法来遍历和提取分隔的子字符串: 1. `hasMoreTokens()`: 检查是否有更多的令牌。如果存在,则返回`true`;否则返回`false`。 2. `nextToken()`: 返回下一个分隔符前的令牌。...

    华为-华为od题库练习题之字符串分隔.zip

    【标题】"华为-华为od题库练习题之字符串分隔.zip" 提供的资源是华为OD(Organizational Development,组织发展)题库中的一个专项练习,主要关注字符串处理技术。这个压缩包可能包含了多个练习题目,旨在帮助学习者...

    java常用字符串方法网络收集txt版

    下面将详细介绍一些Java字符串处理的关键知识点。 1. **字符串类(String)**:Java中的字符串是不可变的,这意味着一旦创建了一个字符串对象,就不能改变其内容。字符串对象是通过`String`类创建的,例如`String str...

    java 中字符串只中英数字混合需要分割的解决办法

    这个方法用来处理java中可能有一些特别的需要,一大串中英文混合,需要中间截断或是中英中间添加一些特别的标识,调用这个方法 第一个参数是要处理的字符串,第二个是要在中英字符中间插入的字符。调用就可以得到想...

    字符串中分离特定字符串隔开的字符串

    最常用的是`split()`方法,它可以根据指定的正则表达式将字符串分割成多个子串。例如,如果你有一个由逗号分隔的字符串,你可以这样做: ```java String str = "苹果,香蕉,橙子"; String[] fruits = str.split(",")...

Global site tag (gtag.js) - Google Analytics