• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • JavaScript
  • ASP.NET
  • PHP
  • 正则表达式
  • AJAX
  • JSP
  • ASP
  • Flex
  • XML
  • 编程技巧
  • Android
  • swift
  • C#教程
  • vb
  • vb.net
  • C语言
  • Java
  • Delphi
  • 易语言
  • vc/mfc
  • 嵌入式开发
  • 游戏开发
  • ios
  • 编程问答
  • 汇编语言
  • 微信小程序
  • 数据结构
  • OpenGL
  • 架构设计
  • qt
  • 微信公众号
您的位置:首页 > 程序设计 >ASP.NET > 10个.NET中删除空白字符串的方法

10个.NET中删除空白字符串的方法

作者: 字体:[增加 减小] 来源:互联网 时间:2017-05-11

通过本文主要向大家介绍了vb.net 字符串函数,vb.net 字符串转数字,vb.net 截取字符串,.net 截取字符串,vb.net 字符串等相关知识,希望对您有所帮助,也希望大家支持linkedu.com www.linkedu.com

我们有无数方法可用于删除字符串中的所有空白,但是哪个更快呢?

介绍

如果你问空白是什么,那说起来还真是有些乱。许多人认为空白就是SPACE 字符(UnicodeU+0020,ASCII 32,HTML ),但它实际上还包括使得版式水平和垂直出现空格的所有字符。事实上,这是一整类定义为Unicode字符数据库的字符。

本文所说的空白,不但指的是它的正确定义,同时也包括string.Replace(” “, “”)方法。

这里的基准方法,将删除所有头尾和中间的空白。这就是文章标题中“所有空白”的含义。

背景

这篇文章一开始是出于我的好奇心。事实上,我并不需要用最快的算法来删除字符串中的空白。

检查空白字符

检查空白字符很简单。所有你需要的代码就是:

char wp = ' '; 
char a = 'a'; 
Assert.True(char.IsWhiteSpace(wp)); 
Assert.False(char.IsWhiteSpace(a)); 
 
但是,当我实现手动优化删除方法时,我意识到这并不像预期得那么好。一些源代码在微软的参考源代码库的char.cs挖掘找到: 
 
public static bool IsWhiteSpace(char c) { 
  if (IsLatin1(c)) { 
    return (IsWhiteSpaceLatin1(c)); 
  } 
  return CharUnicodeInfo.IsWhiteSpace(c); 
} 
 
然后CharUnicodeInfo.IsWhiteSpace成了: 
 
internal static bool IsWhiteSpace(char c) 
{ 
  UnicodeCategory uc = GetUnicodeCategory(c); 
  // In Unicode 3.0, U+2028 is the only character which is under the category "LineSeparator". 
  // And U+2029 is th eonly character which is under the category "ParagraphSeparator". 
  switch (uc) { 
    case (UnicodeCategory.SpaceSeparator): 
    case (UnicodeCategory.LineSeparator): 
    case (UnicodeCategory.ParagraphSeparator): 
      return (true); 
  } 
 
  return (false); 
} 
 
</div>

GetUnicodeCategory()方法调用InternalGetUnicodeCategory()方法,而且实际上相当快,但现在我们依次已经有了4个方法调用!以下这段代码是由一位评论者提供的,可用于快速实现定制版本和JIT默认内联: 
 

// whitespace detection method: very fast, a lot faster than Char.IsWhiteSpace 
[MethodImpl(MethodImplOptions.AggressiveInlining)] // if it's not inlined then it will be slow!!! 
public static bool isWhiteSpace(char ch) { 
  // this is surprisingly faster than the equivalent if statement 
  switch (ch) { 
    case '\u0009': case '\u000A': case '\u000B': case '\u000C': case '\u000D': 
    case '\u0020': case '\u0085': case '\u00A0': case '\u1680': case '\u2000': 
    case '\u2001': case '\u2002': case '\u2003': case '\u2004': case '\u2005': 
    case '\u2006': case '\u2007': case '\u2008': case '\u2009': case '\u200A': 
    case '\u2028': case '\u2029': case '\u202F': case '\u205F': case '\u3000': 
      return true; 
    default: 
      return false; 
  } 
} 
</div>

删除字符串的不同方法

我用各种不同的方法来实现删除字符串中的所有空白。

分离合并法

这是我一直在用的一个非常简单的方法。根据空格字符分离字符串,但不包括空项,然后将产生的碎片重新合并到一起。这方法听上去有点傻乎乎的,而事实上,乍一看,很像是一个非常浪费的解决方式:

public static string TrimAllWithSplitAndJoin(string str) { 
  return string.Concat(str.Split(default(string[]), StringSplitOptions.RemoveEmptyEntries)); 
} 
 
LINQ 
 
这是优雅地声明式地实现这个过程的方法: 
 
public static string TrimAllWithLinq(string str) { 
  return new string(str.Where(c => !isWhiteSpace(c)).ToArray()); 
} 
</div>

正则表达式

正则表达式是非常强大的力量,任何程序员都应该意识到这一点。

static Regex whitespace = new Regex(@"\s+", RegexOptions.Compiled); 
 
public static string TrimAllWithRegex(string str) { 
  return whitespace.Replace(str, ""); 
} 
</div>

字符数组原地转换法

该方法将输入的字符串转换成字符数组,然后原地扫描字符串去除空白字符(不创建中间缓冲区或字符串)。最后,经过“删减”的数组会产生新的字符串。

public static string TrimAllWithInplaceCharArray(string str) { 
  var len = str.Length; 
  var src = str.ToCharArray(); 
  int dstIdx = 0; 
  for (int i = 0; i < len; i++) { 
    var ch = src[i]; 
    if (!isWhiteSpace(ch)) 
      src[dstIdx++] = ch; 
  } 
  return new string(src, 0, dstIdx); 
} 
</div>

字符数组复制法

这种方法类似于字符数组原地转换法,但它使用Array.Copy复制连续非空白“字符串”的同时跳过空格。最后,它将创建一个适当尺寸的字符数组,并用相同的方式返回一个新的字符串。

public static string TrimAllWithCharArrayCopy(string str) {
  var len = str.Length;
  var src = str.ToCharArray();
  int srcIdx = 0, dstIdx = 0, count = 0;
  for (int i = 0; i < len; i++) {
    if (isWhiteSpace(src[i])) {
      count = i - srcIdx;
      Array.Copy(src, srcIdx, src, dstIdx, count);
      srcIdx += count + 1;
      dstIdx += count;
      len--;
    }
  }
  if (dstIdx < len)
    Array.Copy(src, srcIdx, src, dstIdx, len - dstIdx);
  return new string(src, 0, len);
}

</div>

循环交换法

用代码实现循环,并使用StringBuilder类,通过依靠StringBuilder的内在优化来创建新的字符串。为了避免任何其他因素对本实施产生干扰,不调用其他的方法,并且通过缓存到本地变量避免访问类成员。最后通过设置StringBuilder.Length将缓冲区调整到合适大小。

// Code suggested by http://www.codeproject.com/Members/TheBasketcaseSoftware

public static string TrimAllWithLexerLoop(string s) {
  int length = s.Length;
  var buffer = new StringBuilder(s);
  var dstIdx = 0;
  for (int index = 0; index < s.Length; index++) {
    char ch = s[index];
    switch (ch) {
      case '\u0020': case '\u00A0': case '\u1680': case '\u2000': case '\u2001':
      case '\u2002': case '\u2003': case '\u2004': case '\u2005': case '\u2006':
      case '\u2007': case '\u2008': case '\u2009': case '\u200A': case '\u202F':
      case '\u205F': case '\u3000': case '\u2028': case '\u2029': case '\u0009':
      case '\u000A': case '\u000B': case '\u000C': case '\u000D': case '\u0085':
        length--;
        continue;
      default:
        break;
    }
    buffer[dstIdx++] = ch;
  }
  buffer.Length = length;
  return buffer.ToString();;
}
</div>

循环字符法

这种方法几乎和前面的循环交换法相同,不过它采用if语句来调用isWhiteSpace(),而不是乱七八糟的switch伎俩 :)。

public static string TrimAllWithLexerLoopCharIsWhitespce(string s) {
  int length = s.Length;
  var buffer = new StringBuilder(s);
  var dstIdx = 0;
  for (int index = 0; index < s.Length; index++) {
    char currentchar = s[index];
    if (isWhiteSpace(currentchar))
      length--;
    else
      buffer[dstIdx++] = currentchar;
  }
  buffer.Length = length;
  return buffer.ToString();;
}
</div>

原地改变字符串法(不安全)

这种方法使用不安全的字符指针和指针运算来原地改变字符串。我不推荐这个方法,因为它打破了.NET框架在生产中的基本约定:字符串是不可变的。

public static unsafe string TrimAllWithStringInplace(string str) {
  fixed (char* pfixed = str) {
    char* dst = pfixed;
    for (char* p = pfix



 
分享到:QQ空间新浪微博腾讯微博微信百度贴吧QQ好友复制网址打印

您可能想查找下面的文章:

  • 10个.NET中删除空白字符串的方法

相关文章

  • 2017-05-11提交页面的定位--scrollIntoView的用法
  • 2017-05-11ASP.NET Core 导入导出Excel xlsx 文件实例
  • 2017-05-11asp.net 用户控件读取以及赋值
  • 2017-05-11Asp.net的服务器推技术 (Server Push)
  • 2017-05-11Visual Studio 2017创建.net standard类库编译出错原因及解决方法
  • 2017-05-11IIS处理Asp.net请求和Asp.net页面生命周期说明
  • 2017-05-11ASP.NET笔记之 viewstate与cache的使用
  • 2017-05-11asp.net CommunityServer中的wwwStatus
  • 2017-05-11微软发布的Data Access Application Block的使用代码
  • 2017-05-11ASP.NET性能优化之减少请求

文章分类

  • JavaScript
  • ASP.NET
  • PHP
  • 正则表达式
  • AJAX
  • JSP
  • ASP
  • Flex
  • XML
  • 编程技巧
  • Android
  • swift
  • C#教程
  • vb
  • vb.net
  • C语言
  • Java
  • Delphi
  • 易语言
  • vc/mfc
  • 嵌入式开发
  • 游戏开发
  • ios
  • 编程问答
  • 汇编语言
  • 微信小程序
  • 数据结构
  • OpenGL
  • 架构设计
  • qt
  • 微信公众号

最近更新的内容

    • .net生成缩略图及水印图片时出现GDI+中发生一般性错误解决方法
    • C#中的Equals、RefrenceEquals和==的区别与联系
    • asp.net实现根据城市获取天气预报的方法
    • .NET发送邮件遇到问题及解决方法
    • asp.net System.Guid ToString五种格式
    • 解析Asp.net Core中使用Session的方法
    • ASP.NET中MVC传递数据的几种形式总结
    • ASP.NET对无序列表批量操作的三种方法小结
    • asp.net+jquery ajax无刷新登录的实现方法
    • aspx中的mysql操作类sqldatasource使用示例分享

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有