C#如何解决中按字节数截取字符串最后出现乱码问题

这篇文章主要介绍C#如何解决中按字节数截取字符串最后出现乱码问题，文中介绍的非常详细，具有一定的参考价值，感兴趣的小伙伴们一定要看完！

创新互联专注于企业成都全网营销、网站重做改版、镶黄网站定制设计、自适应品牌网站建设、html5、商城系统网站开发、集团公司官网建设、成都外贸网站建设公司、高端网站制作、响应式网页设计等建站业务，价格优惠性价比高，为镶黄等各大城市提供网站开发制作服务。

前言

最近需要用到按字节数截取字符串。在网上找了很多方法。

Encoding.Default.GetString采用的Default

Encoding.UTF8.GetBytes采用的是utf-8编码。这样当然是乱码。尤其出现中文时候。

对这类数据处理当然要用统一的编码来处理。下面话不多说了，来一起看看详细的介绍吧

例子：1

 string msg= Encoding.UTF8.GetString(Encoding.UTF8.GetBytes(strcode));

例子：2

string strcode="我是小明";
byte[] buffer=Encoding.UTF8.GetBytes(strcode);
string msg= Encoding.UTF8.GetString(buffer,0,buffer.Length);

实际结果是截取的结尾会出现乱码。原因是最后的字符是多个字节，被不完整的截取了。

改进后的办法如下：

/// <summary>
 /// 按字节数截取字符串的方法(比SubString好用)
 /// </summary>
 /// <param name="source">要截取的字符串（可空）</param>
 /// <param name="NumberOfBytes">要截取的字节数</param>
 /// <param name="encoding">System.Text.Encoding</param>
 /// <param name="suffix">结果字符串的后缀（超出部分显示为该后缀）</param>
 /// <returns></returns>
 public static string SubStringByBytes(string source, int NumberOfBytes, System.Text.Encoding encoding, string suffix = "...")
 {
  if(string.IsNullOrWhiteSpace(source) || source.Length == 0)
  return source;

  if(encoding.GetBytes(source).Length <= NumberOfBytes)
  return source;

  long tempLen = 0;
  StringBuilder sb = new StringBuilder();
  foreach(var c in source)
  {
  Char[] _charArr = new Char[] { c };
  byte[] _charBytes = encoding.GetBytes(_charArr);
  if((tempLen + _charBytes.Length) > NumberOfBytes)
  {
   if(!string.IsNullOrWhiteSpace(suffix))
   sb.Append(suffix);
   break;
  }
  else
  {
   tempLen += _charBytes.Length;
   sb.Append(encoding.GetString(_charBytes));
  }
  }
  return sb.ToString();
 }
 /// <summary>
 /// 按字节数截取字符串的方法(比SubString好用)
 /// </summary>
 /// <param name="source">要截取的字符串（可空）</param>
 /// <param name="NumberOfBytes">要截取的字节数</param>
 /// <param name="encoding">UTF-8，Unicode，GB2312...</param>
 /// <param name="suffix">结果字符串的后缀（超出部分显示为该后缀）</param>
 /// <returns></returns>
 public static string SubStringByBytes(string source, int NumberOfBytes, string encoding = "UTF-8", string suffix = "...")
 {
  return SubStringByBytes(source, NumberOfBytes, Encoding.GetEncoding(encoding), suffix);
 }

原理很简单，就是截取之前逐个先判断字符是否超出字节长度，如果超出则扔掉整个字符。

在JavaScript里面的Blob对象很容易获取字节长度： var len= new Blob(['字符串']).size;

以上是“C#如何解决中按字节数截取字符串最后出现乱码问题”这篇文章的所有内容，感谢各位的阅读！希望分享的内容对大家有帮助，更多相关知识，欢迎关注创新互联行业资讯频道！

分享标题：C#如何解决中按字节数截取字符串最后出现乱码问题
标题路径：https://www.cdcxhl.com/article4/igegie.html

成都网站建设公司_创新互联，为您提供关键词优化、网站收录、微信小程序、动态网站、App设计、企业建站

声明：本网站发布的内容（图片、视频和文字）以用户投稿、用户转载内容为主，如果涉及侵权请尽快告知，我们将会在第一时间删除。文章观点不代表本网站立场，如需处理请联系客服。电话：028-86922220；邮箱：631063699@qq.com。内容未经允许不得转载，或转载时需注明来源：创新互联

猜你还喜欢下面的内容