正则表达式中的单词边界是什么?

我试图使用正则表达式来匹配空格分隔的数字。我找不到\b(“单词边界”)的精确定义。我假设-12将是一个“整数词”(与\b\-?\d+\b匹配)，但这似乎不起作用。如果能知道方法，我将不胜感激。

[我在Java 1.6中使用Java正则表达式]

例子:

Pattern pattern = Pattern.compile("\\s*\\b\\-?\\d+\\s*");
String plus = " 12 ";
System.out.println(""+pattern.matcher(plus).matches());

String minus = " -12 ";
System.out.println(""+pattern.matcher(minus).matches());

pattern = Pattern.compile("\\s*\\-?\\d+\\s*");
System.out.println(""+pattern.matcher(minus).matches());

这将返回:

true
false
true

当前回答

参考:精通正则表达式(Jeffrey E.F. Friedl) - O'Reilly

\b等价于(?<!\w)(?=\w)|(?<=\w)(?!\w)

2020-10-17 15:28:00

其他回答

我在这里讨论了b风格正则表达式的边界。

简而言之，它们是有条件的。它们的行为取决于它们旁边的东西。

# same as using a \b before:
(?(?=\w) (?<!\w)  | (?<!\W) )

# same as using a \b after:
(?(?<=\w) (?!\w)  | (?!\W)  )

有时候这并不是你想要的。详见我的另一个答案。

2010-11-18 13:35:46

单词边界是一个位置，它的前面有一个单词字符而后面没有一个，或者后面有一个单词字符而前面没有一个。

2009-08-25 01:36:03

在学习正则表达式的过程中，我真的被\b这个元字符困住了。当我反复地问自己“它是什么，它是什么”时，我确实没有理解它的意思。在使用这个网站做了一些尝试之后，我注意到了每个单词开头和单词结尾的粉色垂直破折号。当时我很好地理解了它的意思。现在正好是word(\w)-boundary。

我的观点仅仅是以理解为导向的。其背后的逻辑应该从另一个答案来考察。

2018-06-01 01:19:26

单词边界可以出现在以下三个位置之一:

如果第一个字符是单词字符，则在字符串的第一个字符之前。如果最后一个字符是单词字符，则在字符串的最后一个字符之后。在字符串中的两个字符之间，其中一个是单词字符，另一个不是单词字符。

单词字符是字母-数字;负号不是。摘自正则表达式教程。

2009-08-24 21:05:57

参考:精通正则表达式(Jeffrey E.F. Friedl) - O'Reilly

\b等价于(?<!\w)(?=\w)|(?<=\w)(?!\w)

2020-10-17 15:28:00

正则表达式中的单词边界是什么?

推荐文章

最新文章

标签