- r - 以节省内存的方式增长 data.frame
- ruby-on-rails - ruby/ruby on rails 内存泄漏检测
- android - 无法解析导入android.support.v7.app
- UNIX 域套接字与共享内存(映射文件)
以下 C# 代码在使用 VS2010 构建时似乎比使用 VS2008 运行慢:在 Core i5 Win7 x64 8 GB RAM PC 上,VS2008 构建版本在大约 7.5 秒内对字符串进行排序,而不是VS2010 构建版本需要大约 9 秒。这是为什么?
我的代码有什么问题吗?
排序算法在 VS2010 中有变化吗?
底层 CLR 中是否有任何不同导致性能变差?
using System;
using System.Collections.Generic;
using System.Diagnostics;
using System.Globalization;
using System.Linq;
namespace StringSortCSharp
{
/// <summary>
/// Console app to test string sorting performance in C#.
/// </summary>
class Program
{
/// <summary>
/// Displays the first lines from a vector of strings.
/// </summary>
/// <param name="wishedN">Number of lines to display.</param>
/// <param name="lines">Source lines to display.</param>
private static void DisplayFirst(int wishedN, List<string> lines)
{
int n = Math.Min(wishedN, lines.Count);
for (int i = 0; i < n; i++)
{
Console.WriteLine(" " + lines[i]);
}
Console.WriteLine();
}
/// <summary>
/// Used for random permutation.
/// </summary>
private static Random random = new Random();
/// <summary>
/// Computes a random permutation of the input sequence.
///
/// From:
/// http://stackoverflow.com/questions/375351/most-efficient-way-to-randomly-sort-shuffle-a-list-of-integers-in-c-sharp
///
/// </summary>
/// <typeparam name="T">Type stored in the sequences.</typeparam>
/// <param name="sequence">Input sequence.</param>
/// <returns>Random permutation of the input sequence.</returns>
private static IEnumerable<T> RandomPermutation<T>(IEnumerable<T> sequence)
{
T[] retArray = sequence.ToArray();
for (int i = 0; i < retArray.Length - 1; i += 1)
{
int swapIndex = random.Next(i + 1, retArray.Length);
T temp = retArray[i];
retArray[i] = retArray[swapIndex];
retArray[swapIndex] = temp;
}
return retArray;
}
/// <summary>
/// Builds a list of strings used in the performance benchmark.
/// </summary>
/// <returns>Test list of strings.</returns>
private static List<string> BuildTestLines()
{
// Start with "Lorem ipsum", and repeat it several times, adding some suffix strings.
var lorem = new string[]
{
"Lorem ipsum dolor sit amet, consectetuer adipiscing elit.",
"Maecenas porttitor congue massa. Fusce posuere, magna sed",
"pulvinar ultricies, purus lectus malesuada libero,",
"sit amet commodo magna eros quis urna.",
"Nunc viverra imperdiet enim. Fusce est. Vivamus a tellus.",
"Pellentesque habitant morbi tristique senectus et netus et",
"malesuada fames ac turpis egestas. Proin pharetra nonummy pede.",
"Mauris et orci."
};
int repeatCount = 200 * 1000;
Console.Write("Building test strings");
var testLines = new List<string>();
Console.Write(" (total string count = {0})", repeatCount * lorem.Length);
Console.Write("...");
for (int i = 0; i < repeatCount; i++)
{
for (int j = 0; j < lorem.Length; j++)
{
// Add more stuff to Lorem strings
testLines.Add(lorem[j] + " (#" + i + ")");
}
}
Console.WriteLine("done.");
DisplayFirst(5, testLines);
Console.WriteLine();
// Shuffle the previously built strings.
Console.Write("Shuffling strings...");
var randomLines = new List<string>(RandomPermutation(testLines));
Console.WriteLine("done.");
DisplayFirst(5, randomLines);
Console.WriteLine();
return randomLines;
}
/// <summary>
/// Sort the input lines.
/// </summary>
/// <param name="lines">Input lines to sort.</param>
private static void Test(List<string> lines)
{
// Stopwatch to measure time performance
var timer = new Stopwatch();
Console.Write("Sorting " + lines.Count + " lines...");
// Sort benchmark
timer.Start();
lines.Sort();
timer.Stop();
Console.WriteLine("done.");
// Display results
DisplayFirst(5, lines);
Console.WriteLine();
Console.WriteLine((timer.ElapsedMilliseconds / 1000.0).ToString(CultureInfo.InvariantCulture) + " seconds elapsed.");
}
static void Main(string[] args)
{
Console.WriteLine("*** Testing String Sorting in C# ***");
Console.WriteLine();
// Build test lines used for the sort benchmark
List<string> testLines = BuildTestLines();
// Run the sort test
Test(testLines);
}
}
}
最佳答案
这里是 .NET 版本中使用的排序算法的简要概述。记住 List<T>.Sort()
会很有帮助内部使用 Array<T>.Sort()
Array
进行排序.代码略有改动,但大部分代码保持不变。是的,但变化很小,不会影响性能。考虑对 2000 万个打乱的整数进行排序1:
List<int>.Sort() (20 million).NET 3.5 .NET 4.0 .NET 4.5--------- --------- --------- 2.564s 2.565s 2.337s
v3.5 和 v4.0 在性能方面没有变化。 v4.5 的速度有明显提高。很明显,造成差异的不是实际的排序算法。
在我们进入您的下一个问题之前,让我分享一下我在我的机器上运行您的实际代码的结果:
List<string>.Sort() (1.6 million).NET 3.5 .NET 4.0 .NET 4.5--------- --------- --------- 7.953s 11.267s 10.092s
我得到的结果与您相似。这些结果很好地引导了您的下一个问题:
毫无疑问。那么区别是什么呢?区别在于字符串比较实现。在排序算法的每一步中,它都需要比较两个字符串,而它恰好在 v2.0 和 v4.0 运行时之间以不同的方式进行。 (请参阅下面的额外注释)
证明这一点的最简单方法是强制按顺序位置排序,而不是依赖文化。替换 lines.Sort();
与 lines.Sort(StringComparer.Ordinal);
.这是我测量的结果:
List<string>.Sort(StringComparer.Ordinal) (1.6 million).NET 3.5 .NET 4.0 .NET 4.5--------- --------- --------- 4.088s 3.76s 3.454s
现在,看起来好多了!这或多或少是我所期望的;发布的每个版本的框架速度稳步提高。 MSDN Suggests如果您曾经对字符串进行非语言比较,您应该使用序数比较。
但是,只有当您的比较或排序不区分文化时,这才能解决问题。如果您需要区分文化的排序,似乎您将无法摆脱较慢的执行时间,除非您想恢复到 .NET 3.5 框架。
当您不将比较器传递给 List<T>.Sort()
时或 Array.Sort
,它将使用默认比较器。 .NET 字符串的默认比较器使用线程当前区域性的比较器。从那里,它调用 .NET 运行时 native 库中的一些内部函数。
在 v2.0-3.5 中,它调用 COMNlsInfo::Compare
和 COMNlsInfo::CompareFast
.这是调用堆栈(有点)的样子:
String.CompareTo(string)+--System.Globalization.CompareInfo.Compare(string,string,CompareOptions) +--mscorwks.dll!COMNlsInfo::Compare +--mscorwks.dll!COMNlsInfo::CompareFast
这些函数的类似源代码在 CLI (SSCLI) 的共享源代码实现中可见。它位于 sscli\clr\src\classlibnative\nls\comnlsinfo.cpp
分别在第 1034 行和第 893 行。
然而,在 v4.0 中,调用树发生了相当大的变化:
String.CompareTo(string)+--System.Globalization.CompareInfo.Compare(string,string,CompareOptions) +--clr.dll!COMNlsInfo::InternalCompareString +--clr.dll!SortVersioning::SortDllCompareString +--nlssorting.dll!_SortCompareString +--nlssorting.dll!_AsciiCompareString
我希望我能告诉您为什么一个比另一个慢,但我一点头绪都没有,而且没有用于 .NET 4.0 的 SSCLI 可以与之比较。 .NET 4.0 中对字符串处理的主要更改并非没有问题。一直有性能问题related to strings in .NET 4.0 ,但是它们并不真正适用于此。
1所有测试都在虚拟机中运行。 Win 2008R2 x64 w/4GB 内存和虚拟四核处理器。主机是 Win7 x64 w/24GB RAM 和 Xeon W3540 (2.93ghz) 四核(8 个逻辑处理器)。结果是 5 次运行的平均值,其中删除了最佳和最差时间。
关于c# - VS2010 与 VS2008 中的字符串排序性能下降,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/12156627/
在这段令人惊叹的视频 ( https://www.youtube.com/watch?v=udix3GZouik ) 中,Alex Blom 谈到了 Ember 在移动世界中的“黑客攻击”。 在 22
我们希望通过我们的应用收集使用情况统计信息。因此,我们希望在服务器端的某个地方跟踪用户操作。 就性能而言,哪个选项更合适: 在 App Engine 请求日志中跟踪用户操作。即为每个用户操作写入一个日
在针对对象集合的 LINQ 查询的幕后究竟发生了什么?它只是语法糖还是发生了其他事情使其更有效的查询? 最佳答案 您是指查询表达式,还是查询在幕后的作用? 查询表达式首先扩展为“普通”C#。例如: v
我正在构建一个简单的照片库应用程序,它在列表框中显示图像。 xaml 是:
对于基于 Web 的企业应用程序,使用“静态 Hashmap 存储对象” 和 apache java 缓存系统有何优缺点?哪一个最有利于性能并减少堆内存问题 例如: Map store=Applica
我想知道在性能方面存储类变量的最佳方式是什么。我的意思是,由于 Children() 函数,存储一个 div id 比查找所有其他类名更好。还是把类名写在变量里比较好? 例如这样: var $inne
我已经阅读了所有这些关于 cassandra 有多快的文章,例如单行读取可能需要大约 5 毫秒。 到目前为止,我不太关心我的网站速度,但是随着网站变得越来越大,一些页面开始需要相当多的查询,例如一个页
最近,我在缓存到内存缓存之前的查询一直需要很长时间才能处理!在这个例子中,它花费了 10 秒。在这种情况下,我要做的就是获得 10 个最近的点击。 我感觉它加载了所有 125,592 行然后只返回 1
我找了几篇文章(包括SA中的一些问题),试图找到基本操作的成本。 但是,我尝试制作自己的小程序,以便自己进行测试。在尝试测试加法和减法时,我遇到了一些问题,我用简单的代码向您展示了这一点
这个问题在这里已经有了答案: Will Java app slow down by presence of -Xdebug or only when stepping through code? (
我记得很久以前读过 with() 对 JavaScript 有一些严重的性能影响,因为它可能对范围堆栈进行非确定性更改。我很难找到最近对此的讨论。这仍然是真的吗? 最佳答案 与其说 with 对性能有
我们有一个数据仓库,其中包含非规范化表,行数从 50 万行到 6 多万行不等。我正在开发一个报告解决方案,因此出于性能原因我们正在使用数据库分页。我们的报告有搜索条件,并且我们已经创建了必要的索引,但
我有一条有效的 SQL 语句,但需要很长时间才能处理 我有一个 a_log 表和一个 people 表。我需要在 people 表中找到给定人员的每个 ID 的最后一个事件和关联的用户。 SELECT
很难说出这里问的是什么。这个问题是含糊的、模糊的、不完整的、过于宽泛的或修辞性的,无法以目前的形式得到合理的回答。如需帮助澄清此问题以便重新打开它,visit the help center 。 已关
通常当我建立一个站点时,我将所有的 CSS 放在一个文件中,并且一次性定义与一组元素相关的所有属性。像这样: #myElement { color: #fff; background-
两者之间是否存在任何性能差异: p { margin:0px; padding:0px; } 并省略最后的分号: p { margin:0px; padding:0px } 提前致谢!
我的应用程序 (PHP) 需要执行大量高精度数学运算(甚至可能出现一共100个数字) 通过这个论坛的最后几篇帖子,我发现我必须使用任何高精度库,如 BC Math 或 GMP,因为 float 类型不
我一直在使用 javamail 从 IMAP 服务器(目前是 GMail)检索邮件。 Javamail 非常快速地从服务器检索特定文件夹中的消息列表(仅 id),但是当我实际获取消息(仅包含甚至不包含
我非常渴望开发我的第一个 Ruby 应用程序,因为我的公司终于在内部批准了它的使用。 在我读到的关于 Ruby v1.8 之前的所有内容中,从来没有任何关于性能的正面评价,但我没有发现关于 1.9 版
我是 Redis 的新手,我有一个包含数百万个成员(member) ID、电子邮件和用户名的数据集,并且正在考虑将它们存储在例如列表结构中。我认为 list 和 sorted set 可能最适合我的情
我是一名优秀的程序员,十分优秀!