- android - RelativeLayout 背景可绘制重叠内容
- android - 如何链接 cpufeatures lib 以获取 native android 库?
- java - OnItemClickListener 不起作用,但 OnLongItemClickListener 在自定义 ListView 中起作用
- java - Android 文件转字符串
这是我工作中长期存在的问题,我意识到我仍然没有好的解决方案......
C 天真地为一个 int 定义了它所有的字符测试函数:
int isspace(int ch);
但是 char 通常是带符号的,并且完整的字符通常不适合 int 或用于字符串的任何单个存储单元******。
而这些函数已经成为当前C++函数和方法的逻辑模板,为当前的标准库奠定了基础。事实上,他们仍然受到支持,afaict。
因此,如果您使用 isspace(*pchar),您最终可能会遇到符号扩展问题。它们很难被发现,因此根据我的经验,它们很难防范。
同样,因为 isspace() 和它的同类都采用整数,并且因为字符的实际宽度通常在没有字符串分析的情况下是未知的 - 这意味着任何现代字符库基本上都不应该围绕 char 或 wchar_t 进行运输但是只有指针/迭代器,因为只有通过分析字符流才能知道它有多少组成一个逻辑字符,我对如何最好地处理这些问题有点不知所措?
我一直期待一个真正健壮的库,它基于抽象出任何字符的大小因子,并且只使用字符串(提供 isspace 等),但要么我错过了它,要么有另一个更简单的库面对我的解决方案,你们所有人(知道自己在做什么)都在使用...
** 对于可以完全包含一个完整字符的固定大小的字符编码,这些问题不会出现 - UTF-32 显然是具有这些特征的唯一选项(或将自身限制为 ASCII 或一些这样的)。
“您如何以不会遇到两个问题的方式测试空格、可打印等:
1) 符号展开,以及
2)变宽字符问题
毕竟,大多数字符编码都是可变宽度的:UTF-7、UTF-8、UTF-16,以及较旧的标准,如 Shift-JIS。如果编译器将 char 视为带符号的 8 位单元,即使扩展的 ASCII 也可能存在简单的符号扩展问题。
无论您的 char_type 大小如何,对于大多数字符编码方案来说都是错误的。
这个问题存在于标准C库中,也存在于C++标准库中;它仍然试图传递 char 和 wchar_t,而不是各种 isspace、isprint 等实现中的字符串迭代器。
实际上,正是这些类型的函数打破了 std::string 的通用性。如果它只在存储单元中工作,而不试图假装将存储单元的含义理解为逻辑字符(例如 isspace),那么抽象会更诚实,并且会迫使我们程序员去寻找在其他地方寻找有效的解决方案......
所有参与的人。在这次讨论和WChars, Encodings, Standards and Portability之间我对这些问题的处理要好得多。虽然没有简单的答案,但每一点理解都会有所帮助。
最佳答案
How do you test for whitespace, isprintable, etc., in a way that doesn't suffer from two issues:
1) Sign expansion
2) variable-width character issues
After all, all commonly used Unicode encodings are variable-width, whether programmers realize it or not: UTF-7, UTF-8, UTF-16, as well as older standards such as Shift-JIS...
显然,您必须使用支持 Unicode 的库,因为您已经(正确地)证明了 C++03 标准库不是。 C++11 库得到了改进,但对于大多数用途来说仍然不够好。是的,一些操作系统有一个 32 位的 wchar_t,这使得它们能够正确处理 UTF32,但这是一个实现,并且不受 C++ 的保证,并且对于许多 unicode 任务来说远远不够,例如遍历字形(字母) .
IBMICU
Libiconv
microUTF-8
UTF-8 CPP, version 1.0
utfproc
以及更多 http://unicode.org/resources/libraries.html .
如果问题不是关于特定字符测试,而是关于一般代码实践:做你的框架做的任何事情。如果您正在为 linux/QT/networking 编码,请在内部以 UTF-8 格式保存所有内容。如果您使用 Windows 进行编码,请在内部以 UTF-16 格式保存所有内容。如果您需要弄乱代码点,请将所有内容保存在 UTF-32 内部。否则(对于可移植的通用代码),随心所欲,因为无论如何,您都必须为某些操作系统或其他操作系统进行翻译。
关于c++ - 您如何处理标准库中的 signed char -> int 问题?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/8083083/
关闭。这个问题是off-topic .它目前不接受答案。 想要改进这个问题? Update the question所以它是on-topic用于堆栈溢出。 关闭 12 年前。 Improve thi
我有一个动态网格,其中的数据功能需要正常工作,这样我才能逐步复制网格中的数据。假设在第 5 行中,我输入 10,则从第 6 行开始的后续行应从 11 开始读取,依此类推。 如果我转到空白的第一行并输入
我有一个关于我的按钮消失的问题 我已经把一个图像作为我的按钮 用这个函数动画 function example_animate(px) { $('#cont
我有一个具有 Facebook 连接和经典用户名/密码登录的网站。目前,如果用户单击 facebook_connect 按钮,系统即可运行。但是,我想将现有帐户链接到 facebook,因为用户可以选
我有一个正在为 iOS 开发的应用程序,该应用程序执行以下操作 加载和设置注释并启动核心定位和缩放到位置。 map 上有很多注释,从数据加载不会花很长时间,但将它们实际渲染到 map 上需要一段时间。
我被推荐使用 Heroku for Ruby on Rails 托管,到目前为止,我认为我真的会喜欢它。只是想知道是否有人可以帮助我找出问题所在。 我按照那里的说明在该网站上创建应用程序,创建并提交
我看过很多关于 SSL 错误的帖子和信息,我自己也偶然发现了一个。 我正在尝试使用 GlobalSign CA BE 证书通过 Android WebView 访问网页,但出现了不可信错误。 对于大多
我想开始使用 OpenGL 3+ 和 4,但我在使用 Glew 时遇到了问题。我试图将 glew32.lib 包含在附加依赖项中,并且我已将库和 .dll 移动到主文件夹中,因此不应该有任何路径问题。
我已经盯着这两个下载页面的源代码看了一段时间,但我似乎找不到问题。 我有两个下载页面,一个 javascript 可以工作,一个没有。 工作:http://justupload.it/v/lfd7不是
我一直在使用 jQuery,只是尝试在单击链接时替换文本字段以及隐藏/显示内容项。它似乎在 IE 中工作得很好,但我似乎无法让它在 FF 中工作。 我的 jQuery: $(function() {
我正在尝试为 NDK 编译套接字库,但出现以下两个错误: error: 'close' was not declared in this scope 和 error: 'min' is not a m
我正在使用 Selenium 浏览器自动化框架测试网站。在测试过程中,我切换到特定的框架,我们将其称为“frame_1”。后来,我在 Select 类中使用了 deselectAll() 方法。不久之
我正在尝试通过 Python 创建到 Heroku PostgreSQL 数据库的连接。我将 Windows10 与 Python 3.6.8 和 PostgreSQL 9.6 一起使用。 我从“ht
我有一个包含 2 列的数据框,我想根据两列之间的比较创建第三列。 所以逻辑是:第 1 列 val = 3,第 2 列 val = 4,因此新列值什么都没有 第 1 列 val = 3,第 2 列 va
我想知道如何调试 iphone 5 中的 css 问题。 我尝试使用 firelite 插件。但是从纵向旋转到横向时,火石占据了整个屏幕。 有没有其他方法可以调试 iphone 5 中的 css 问题
所以我有点难以理解为什么这不起作用。我正在尝试替换我正在处理的示例站点上的类别复选框。我试图让它做以下事情:未选中时以一种方式出现,悬停时以另一种方式出现(选中或未选中)选中时以第三种方式出现(而不是
Javascript CSS 问题: 我正在使用一个文本框来写入一个 div。我使用以下 javascript 获取文本框来执行此操作: function process_input(){
你好,我很难理解 P、NP 和多项式时间缩减的主题。我试过在网上搜索它并问过我的一些 friend ,但我没有得到任何好的答案。 我想问一个关于这个话题的一般性问题: 设 A,B 为 P 中的语言(或
你好,我一直在研究 https://leetcode.com/problems/2-keys-keyboard/并想到了这个动态规划问题。 您从空白页上的“A”开始,完成后得到一个数字 n,页面上应该
我正在使用 Cocoapods 和 KIF 在 Xcode 服务器上运行持续集成。我已经成功地为一个项目设置了它来报告每次提交。我现在正在使用第二个项目并收到错误: Bot Issue: warnin
我是一名优秀的程序员,十分优秀!