- c - 在位数组中找到第一个零
- linux - Unix 显示有关匹配两种模式之一的文件的信息
- 正则表达式替换多个文件
- linux - 隐藏来自 xtrace 的命令
正在运行 pygments以下 C++ 文本的默认词法分析器:class foo{};
,结果如下:
(Token.Keyword, 'class')
(Token.Text, ' ')
(Token.Name.Class, 'foo')
(Token.Punctuation, '{')
(Token.Punctuation, '}')
(Token.Punctuation, ';')
请注意 token foo
的类型为 Token.Name.Class
。
如果我将类名更改为 foobar
我希望能够仅在触摸的标记上运行 default 词法分析器,在本例中为原始标记 foo
和 {
。
问:如何保存词法分析器状态,以便标记化 foobar{
将生成类型为 Token.Name.Class
的标记?
拥有此功能可以优化大型源文件的语法突出显示,例如在文件中间发生更改(用户正在键入文本)。似乎没有记录在案的执行此操作的方法,也没有关于如何使用默认 pygments lexers 执行此操作的信息。 .
是否有任何其他支持此行为的语法高亮系统?
编辑:
这里有一个关于性能的例子:http://tpcg.io/ESYjiF
最佳答案
根据我对源代码的理解,你想要的是不可能的。
我不会挖掘并尝试解释每一行相关的代码,但基本上,这就是发生的事情:
pygments.lexers.c_cpp.CLexer
, 它继承自 pygments.lexer.RegexLexer
.pygments.lex(lexer, code)
函数只是在 lexer
上调用 get_tokens
方法并处理错误。lexer.get_tokens
基本上解析 unicode 字符串中的源代码并调用 self.get_tokens_unprocessed
get_tokens_unprocessed
在您的案例中由每个 Lexer 定义,相关方法是 pygments.lexers.c_cpp.CFamilyLexer.get_tokens_unprocessed
.CFamilyLexer.get_tokens_unprocessed
基本上从 RegexLexer.get_tokens_unprocessed
获取 token 并对其中一些进行再加工。最后,RegexLexer.get_tokens_unprocessed
循环定义的标记类型(类似于 (("function", ('pattern-to-find-c-function',)), ("class", ('function-to-find-c-class' ,)))
) 并针对每种类型(function
、class
、comment
...)在源代码中找到所有匹配项文本,然后处理下一个类型。
这种行为使您无法实现您想要的,因为它在标记类型上循环,而不是在文本上循环。
为了使我的观点更加明显,我在库中添加了 2 行代码,file: pygments/lexer.py
, line: 628
for rexmatch, action, new_state in statetokens:
print('looking for {}'.format(action))
m = rexmatch(text, pos)
print('found: {}'.format(m))
然后用这段代码运行它:
import pygments
import pygments.lexers
lexer = pygments.lexers.get_lexer_for_filename("foo.h")
sample="""
class foo{};
"""
print(list(lexer.get_tokens(sample)))
输出:
[...]
looking for Token.Keyword.Reserved
found: None
looking for Token.Name.Builtin
found: None
looking for <function bygroups.<locals>.callback at 0x7fb1f29b52f0>
found: None
looking for Token.Name
found: <_sre.SRE_Match object; span=(6, 9), match='foo'>
[...]
如您所见, token 类型是代码迭代的对象。
考虑到这一点以及(如 Tarun Lalwani 在评论中所说)单个新字符可以破坏整个源代码结构这一事实,您最好在每次更新时重新对整个文本进行词法分析。
关于Python pygments 词法分析器状态保存,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/50943417/
我尝试根据表单元素的更改禁用/启用保存按钮。但是,当通过弹出按钮选择更改隐藏输入字段值时,保存按钮不受影响。 下面是我的代码。我正在尝试序列化旧的表单值并与更改后的表单值进行比较。但我猜隐藏的字段值无
我正在尝试保存模型的实例,但我得到了 Invalid EmbeddedDocumentField item (1) 其中 1 是项目的 ID(我认为)。 模型定义为 class Graph(Docum
我有一个非常奇怪的问题......在我的 iPhone 应用程序中,用户可以打开相机胶卷中的图像,在我的示例中 1920 x 1080 像素 (72 dpi) 的壁纸。 现在,想要将图像的宽度调整为例
目前,我正在使用具有排序/过滤功能的数据表成功地从我的数据库中显示图像元数据。在我的数据表下方,我使用第三方图像覆盖流( http://www.jacksasylum.eu/ContentFlow/
我的脚本有问题。我想按此顺序执行以下步骤: 1. 保存输入字段中的文本。 2. 删除输入字段中的所有文本。 3. 在输入字段中重新加载之前删除的相同文本。 我的脚本的问题是 ug()- 函数在我的文本
任何人都可以帮助我如何保存多对多关系吗?我有任务,用户可以有很多任务,任务可以有很多用户(多对多),我想要实现的是,在更新表单中,管理员可以将多个用户分配给特定任务。这是通过 html 多选输入来完成
我在 Tensorflow 中训练了一个具有批归一化的模型。我想保存模型并恢复它以供进一步使用。批量归一化是通过 完成的 def batch_norm(input, phase): retur
我遇到了 grails 的问题。我有一个看起来像这样的域: class Book { static belongsTo = Author String toString() { tit
所以我正在开发一个应用程序,一旦用户连接(通过 soundcloud),就会出现以下对象: {userid: userid, username: username, genre: genre, fol
我正在开发一个具有多选项卡布局的 Angular 7 应用程序。每个选项卡都包含一个组件,该组件可以引用其他嵌套组件。 当用户选择一个新的/另一个选项卡时,当前选项卡上显示的组件将被销毁(我不仅仅是隐
我尝试使用 JEditorPane 进行一些简单的文本格式化,但随着知识的增长,我发现 JTextPane 更容易实现并且更强大。 我的问题是如何将 JTextPane 中的格式化文本保存到文件?它应
使用 Docker 相当新。 我为 Oracle 11g Full 提取了一个图像。创建了一个数据库并将应用程序安装到容器中。 正确配置后,我提交了生成 15GB 镜像的容器。 测试了该图像的新容器,
我是使用 Xcode 和 swift 的新手,仍在学习中。我在将核心数据从实体传递到文本字段/标签时遇到问题,然后用户可以选择编辑和保存记录。我的目标是,当用户从 friendslistViewCon
我正在用 Java 编写 Android 游戏,我需要一种可靠的方法来快速保存和加载应用程序状态。这个问题似乎适用于大多数 OO 语言。 了解我需要保存的内容:我正在使用策略模式来控制我的游戏实体。我
我想知道使用 fstream 加载/保存某种结构类型的数组是否是个好主意。注意,我说的是加载/保存到二进制文件。我应该加载/保存独立变量,例如 int、float、boolean 而不是结构吗?我这么
我希望能够将 QNetworkReply 保存到 QString/QByteArray。在我看到的示例中,它们总是将流保存到另一个文件。 目前我的代码看起来像这样,我从主机那里得到一个字符串,我想做的
我正在创建一个绘图应用程序。我有一个带有 Canvas 的自定义 View ,它根据用户输入绘制线条: class Line { float startX, startY, stopX, stop
我有 3 个 Activity 第一个 Activity 调用第二个 Activity ,第二个 Activity 调用第三个 Activity 。 第二个 Activity 使用第一个 Activi
我想知道如何在 Xcode 中保存 cookie。我想使用从一个网页获取的 cookie 并使用它访问另一个网页。我使用下面的代码登录该网站,我想保存从该连接获得的 cookie,以便在我建立另一个连
我有一个 SQLite 数据库存储我的所有日历事件,建模如下: TimerEvent *Attributes -date -dateForMark -reminder *Relat
我是一名优秀的程序员,十分优秀!