- r - 以节省内存的方式增长 data.frame
- ruby-on-rails - ruby/ruby on rails 内存泄漏检测
- android - 无法解析导入android.support.v7.app
- UNIX 域套接字与共享内存(映射文件)
我正在尝试使用 utf8 从 utf-8 string
有效地计算 rune 图书馆。这个例子是否是最佳的,因为它不复制底层数据?
https://golang.org/pkg/unicode/utf8/#example_DecodeRuneInString
func main() {
str := "Hello, 世界" // let's assume a runtime-provided string
for len(str) > 0 {
r, size := utf8.DecodeRuneInString(str)
fmt.Printf("%c %v\n", r, size)
str = str[size:] // performs copy?
}
}
我找到了 StringHeader在(不安全的)反射库中。这是 Go 中 string
的确切结构吗?如果是这样,可以想象对字符串进行 slice 只是更新 Data
或分配一个新的 StringHeader
。
type StringHeader struct {
Data uintptr
Len int
}
Bonus:我在哪里可以找到执行 string
slice 的代码,以便我自己查找?这些中的任何一个?
https://golang.org/src/runtime/slice.go
https://golang.org/src/runtime/string.go
这related SO answer建议运行时字符串在从 string
转换为 []byte
时产生一个副本。
最佳答案
does slice of string perform copy of underlying data?
不,它没有。请参阅 Russ Cox 的这篇文章:
A string is represented in memory as a 2-word structure containing a pointer to the string data and a length. Because the string is immutable, it is safe for multiple strings to share the same storage, so slicing s results in a new 2-word structure with a potentially different pointer and length that still refers to the same byte sequence. This means that slicing can be done without allocation or copying, making string slices as efficient as passing around explicit indexes.
一个 slice 基本上由三样东西组成:长度、容量和指向底层数组中某个位置的指针。
因此, slice 本身不是很大:整数和指针(可能是实现细节中的一些其他小东西)。因此复制 slice 所需的分配非常小,并且不依赖于底层数组的大小。当你简单地更新长度、容量和指针位置时,不需要新的分配,比如在第 2 行:
foo := []int{3, 4, 5, 6}
foo = foo[1:]
相反,当必须分配新的底层数组时,性能会受到影响。
Go 中的字符串是不可变的。因此,要更改字符串,您需要制作一个新字符串。然而,字符串与字节 slice 密切相关,例如您可以使用
从字符串创建字节 slicefoo := `here's my string`
fooBytes := []byte(foo)
我相信这会分配一个新的字节数组,因为:
a string is in effect a read-only slice of bytes
根据 Go 博客(参见 Strings, bytes, runes and characters in Go)。通常,您可以使用 slice 来更改底层数组的内容,因此要从字符串中生成可用的字节 slice ,您必须制作一个副本以防止用户更改本应不可变的内容。
你可以使用 performance profiling和 benchmarking以进一步了解您的程序的性能。
一旦你有了你的 byte slice ,fooBytes
,重新 slice 不会分配一个新的数组,它只是分配一个新的片,它很小。这似乎也是 slice 字符串的作用。
请注意,您不需要使用 utf8
程序包来计算 utf8 字符串中的单词数,但如果您愿意,也可以继续这样做。 Go 原生处理 utf8。但是,如果您想遍历字符,则不能将字符串表示为 byte slice 段,因为您可能有多字节字符。相反,您需要将其表示为一段 rune :
foo := `here's my string`
fooRunes := []rune(foo)
根据我的经验,这种将字符串转换为一段 rune 的操作很快(在我完成的基准测试中微不足道,但可能有分配)。现在您可以遍历 fooRunes
来计算单词数,不需要 utf8
包。或者,您可以跳过显式 []rune(foo)
转换并通过在字符串上使用 for ... range
循环隐式执行此操作,因为它们很特殊:
A for range loop, by contrast, decodes one UTF-8-encoded rune on each iteration. Each time around the loop, the index of the loop is the starting position of the current rune, measured in bytes, and the code point is its value.
关于string - 字符串 slice 是否执行基础数据的复制?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/52395730/
我有一个“有趣”的问题,即以两种不同的方式运行 wine 会导致: $> wine --version /Applications/Wine.app/Contents/Resources/bin/wi
我制作了这个网络抓取工具来获取网页中的表格。我使用 puppeteer (不知道 crontab 有问题)、Python 进行清理并处理数据库的输出 但令我惊讶的是,当我执行它时 */50 * * *
JavaScript 是否被调用或执行取决于什么?准确地说,我有两个函数,它们都以相同的方式调用: [self.mapView stringByEvaluatingJavaScriptFromStri
我目前正在使用 python 做一个机器学习项目(这里是初学者,从头开始学习一切)。 只是想知道 statsmodels 的 OLS 和 scikit 的 PooledOlS 使用我拥有的相同面板数据
在使用集成对象模型 (IOM) 后,我可以执行 SAS 代码并将 SAS 数据集读入 .Net/C# 数据集 here . 只是好奇,使用 .Net 作为 SAS 服务器的客户端与使用 Enterpr
有一些直接的 jQuery 在单击时隐藏打开的 div 未显示,但仍将高度添加到导航中以使其看起来好像要掉下来了。 这个脚本工作正常: $(document).ready(funct
这个问题已经有答案了: How do I compare strings in Java? (23 个回答) 已关闭 4 年前。 这里是 Java 新手,我正在使用 NetBeans 尝试一些简单的代
如果我将它切换到 Python 2.x,它执行 10。这是为什么? 训练逻辑回归模型 import keras.backend as
我有两个脚本,它们包含在 HTML 正文中。在第一个脚本中,我初始化一个 JS 对象,该对象在第二个脚本标记中引用。 ... obj.a = 1000; obj.
每当我运行该方法时,我都会收到一个带有数字的错误 以下是我的代码。 public String getAccount() { String s = "Listing the accounts";
我已经用 do~while(true) 创建了我的菜单;但是每次用户输入一个数字时,它不会运行程序,而是再次显示菜单!你怎么看? //我的主要方法 public static void main(St
执行命令后,如何让IPython通知我?我可以使用铃声/警报还是通过弹出窗口获取它?我正在OS X 10.8.5的iTerm上运行Anaconda。 最佳答案 使用最新版本的iTerm,您可以在she
您好,我刚刚使用菜单栏为 Swing 编写了代码。但是问题出现在运行中。我输入: javac Menu.java java Menu 它没有给出任何错误,但 GUI 没有显示。这是我的源代码以供引用:
我觉得这里缺少明显的东西,但是我看不到它写在任何地方。 我使用Authenticode证书对可执行文件进行签名,但是当我开始学习有关它的更多信息时,我对原样的值(value)提出了质疑。 签名的exe
我正在设计一个应用程序,它使用 DataTables 中的预定义库来创建数据表。我想对数据表执行删除操作,为此应在按钮单击事件上执行 java 脚本。 $(document).ready(functi
我是 Haskell 新手,如果有人愿意帮助我,我会很高兴!我试图让这个程序与 do while 循环一起工作。 第二个 getLine 命令的结果被放入变量 goGlenn 中,如果 goGlenn
我有一个用 swing 实现迷你游戏的程序,在主类中我有一个循环,用于监听游戏 map 中的 boolean 值。使用 while 实现的循环不会执行一条指令,如果它是唯一的一条指令,我不知道为什么。
我正在尝试开发一个连接到 Oracle 数据库并执行函数的 Java 应用程序。如果我在 Eclipse 中运行该应用程序,它可以工作,但是当我尝试在 Windows 命令提示符中运行 .jar 时,
我正在阅读有关 Java 中的 Future 和 javascript 中的 Promises 的内容。下面是我作为示例编写的代码。我的问题是分配给 future 的任务什么时候开始执行? 当如下行创
我有一个常见的情况,您有两个变量(xSpeed 和 ySpeed),当它们低于 minSpeed 时,我想将它们独立设置为零,并在它们都为零时退出。 最有效的方法是什么?目前我有两种方法(方法2更干净
我是一名优秀的程序员,十分优秀!