博客
关于我
强烈建议你试试无所不能的chatGPT,快点击我
solr系统query检索词特殊字符的处理
阅读量:5129 次
发布时间:2019-06-13

本文共 2064 字,大约阅读时间需要 6 分钟。

solr是基于 lucence开发的应用,如果query中带有非法字符串,结果很可能是检索出所有内容或者直接报错,所以你对用户的输入必须要先做处理。输入星号,能够检索出所有内容;输入加号,则会报错。

官方的处理办法(java,因为solr是java开发的):

  1. https:
    //svn.apache.org/repos/asf/lucene/dev/trunk/solr/solrj/src/java/org/apache/solr/client/solrj/util/ClientUtils.java
  2.  
  3. public static String escapeQueryChars(String s) {
  4. StringBuilder sb =
    new StringBuilder();
  5. for (int i = 0; i < s.length(); i++) {
  6. char c = s.charAt(i);
  7. // These characters are part of the query syntax and must be escaped
  8. if (c == '\\' || c == '+' || c == '-' || c == '!' || c == '(' || c == ')' || c == ':'
  9. || c ==
    '^' || c == '[' || c == ']' || c == '\"' || c == '{' || c == '}' || c == '~'
  10. || c ==
    '*' || c == '?' || c == '|' || c == '&' || c == ';' || c == '/'
  11. || Character.isWhitespace(c)) {
  12. sb.append(
    '\\');
  13. }
  14. sb.append(c);
  15. }
  16. return sb.toString();
  17. }

翻译的php版本(利用preg_replace函数进行正则替换):

  1. static public function escape($value)
  2. {
  3. //list taken from http://lucene.apache.org/java/docs/queryparsersyntax.html#Escaping%20Special%20Characters
  4. $pattern =
    '/(\+|-|&|\||!|\(|\)|\{|}|\[|]|\^|"|~|\*|\?|:|;|~|\/)/';
  5. $replace =
    '\\\$1';
  6.  
  7. return preg_replace($pattern, $replace, $value);
  8. }

翻译后的python版本:

    1. import re
    2. def escape_solr(word):
    3. return re.sub('(\\\|\+|-|&|\|\||!|\(|\)|\{|}|\[|]|\^|"|~|\*|\?|:|;|/|\~)','\\\1', word )

C#版

///     /// solr查询字符串特殊字符转义    ///     ///     /// 
public static String escapeQueryChars(String s) { StringBuilder sb = new StringBuilder(); var ss = s.ToCharArray(); foreach (var c in ss) { // These characters are part of the query syntax and must be escaped if (c == '\\' || c == '+' || c == '-' || c == '!' || c == '(' || c == ')' || c == ':' || c == '^' || c == '[' || c == ']' || c == '\"' || c == '{
' || c == '}' || c == '~' || c == '*' || c == '?' || c == '|' || c == '&' || c == ';' || c == '/' ) { sb.Append('\\'); } sb.Append(c); } return sb.ToString(); }

 

转载于:https://www.cnblogs.com/cuihongyu3503319/p/9494261.html

你可能感兴趣的文章
关于CefSharp的坎坷之路
查看>>
ubuntu文件乱码
查看>>
bash学习:登陆、非登陆shell,交互、非交互shell,以及它们的startup文件
查看>>
[题目] JavaScript 练习题目(二) [20-40]
查看>>
SpringBoot非官方教程 | 第六篇:springboot整合mybatis
查看>>
alibaba之Nacos
查看>>
实现memcpy函数
查看>>
Vue 中使用 jQuery
查看>>
数据采集为什么要用IP代理?
查看>>
Dynamics 365中的事件框架与事件执行管道(Event execution pipeline)
查看>>
Errors occurred during the build. Errors running builder 'JavaScript Validator'
查看>>
jquery自定义对话框alert、confirm和prompt
查看>>
intellijj idea正则替换下划线为驼峰
查看>>
《漫画线性代数》读书笔记 用矩阵解方程组
查看>>
关于flume的几道题
查看>>
Java Spring学习笔记 01.@Autowired与@Resource区别?
查看>>
python 小试牛刀之信息管理
查看>>
PHPStorm配置自己喜欢的主题
查看>>
小程序爬坑记录-wxml
查看>>
windows服务与控制台应用程序之HttpWebResponse的使用
查看>>