惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

I
InfoQ
博客园_首页
美团技术团队
M
MIT News - Artificial intelligence
人人都是产品经理
人人都是产品经理
Blog — PlanetScale
Blog — PlanetScale
H
Help Net Security
J
Java Code Geeks
T
Tailwind CSS Blog
Jina AI
Jina AI
量子位
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
G
Google Developers Blog
爱范儿
爱范儿
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
宝玉的分享
宝玉的分享
小众软件
小众软件
MongoDB | Blog
MongoDB | Blog
博客园 - 三生石上(FineUI控件)
L
LangChain Blog
酷 壳 – CoolShell
酷 壳 – CoolShell
V
Visual Studio Blog
博客园 - Franky
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知

晚花行乐

马克卡尼在2026年达沃斯论坛上的讲话(阅读材料) | 晚花行乐 鸡娃如何用力才是恰到好处 | 晚花行乐 读万卷书,行万里路的辩证关系 | 晚花行乐 反对培训机构掐尖招生 | 晚花行乐 小泽和建国会谈最后10分钟全文(阅读材料) | 晚花行乐 来看看 DeepSeek 怎么鸡娃 | 晚花行乐 谈谈基本功 | 晚花行乐 惠普 ProDesk SFF PC 各系列参数对比 | 晚花行乐 解决瘦客户机上安装 Debian 12 启动失败问题 | 晚花行乐 意拾喻言:老外写的文言文 | 晚花行乐 笠翁对韵中的典故(十三元) | 晚花行乐 谈谈中考取消四小门 | 晚花行乐 亚马逊云科技产品免费试用攻略(3) - 对象存储服务 | 晚花行乐 在 Windows 10 LTSC 版本上安装 WSL2 | 晚花行乐 Debian 12 的常用配置项 | 晚花行乐 在 Debian 12 上安装 Nvidia 显卡驱动程序 | 晚花行乐 解决 Debian 12 关机失败问题 | 晚花行乐 解决 VS Code 自动更新版本后卡在连接界面 | 晚花行乐 观看巴黎奥运会有感 | 晚花行乐 在 Windows10 上安装惠普旧打印机驱动程序 | 晚花行乐 欢迎关注公众号:晚花行乐 | 晚花行乐 如何编写拼写检查器 | 晚花行乐 亚马逊云科技产品免费试用攻略(2) - 云服务器 | 晚花行乐 Pandas 中 axis 参数的理解(附实例) | 晚花行乐 我打算命个名,叫什么什么 Manager | 晚花行乐 上海武康路历史建筑一览 | 晚花行乐 观看马拉松的感悟 | 晚花行乐 Python 保存 Cookies 到文件并再次读取 | 晚花行乐 如何为 Hugo 静态网站添加评论功能 | 晚花行乐 Linux 共享打印服务 CUPS | 晚花行乐
Python 实现简单的数学表达式解析并处理 | 晚花行乐
2023-12-27 · via 晚花行乐

对于任意深度的数学表达式,希望使用 Python 解析,然后按照某种规则处理其中的元素。这里最终结果只是对单个元素的字面处理,而没有涉及表达式的表示和运算。

问题

任意数学表达式,包含数字、变量、四则运算符、函数名称、括号等符号,比如下面的例子:

A * (B + 3) / SUM(C+D)

我们希望按照任意的规则去处理其中的某些类型的符号,比如:

  • 去掉函数名称,得到 A*(B+3)/(C+D)
  • 替换变量,得到 AA*(BB+3)/SUM(CC+DD)

分词-Tokenize

首先我们需要设计一个函数把表达式的每个符号分隔开,并且根据字面量的值来判断所属的类型,跟我们人类观察的方法完全一样。比如下面的表达式

A * (B + 3) / SUM(C+D)

我们从左往右观察的时候,心里会想:

A → 字母 → 变量
空格 → 忽略 → 忽略
\* → 属于[+-*/]中的一种 → 运算符
( → 属于[()]中的一种 → 括号
B → 字母 → 变量

….以此类推

那么需要设计一个 tokenize() 函数,将原始表达式逐个按照字符的字面量划分类型。同时,将这个函数设计为生成器,使代码更简洁高效。代码如下:

def tokenize(s):
    toks = re.compile(r' +|[\d\.]+|[A-Za-z_0-9]+|[\(\)]|[\+\-\*\/]')

    for match in toks.finditer(s):
        s = match.group(0)
        if s[0] == ' ':
            continue
        elif s[0] in '()':
            yield (s, s)
        elif s[0].isdigit():
            yield ('NUMBER', s)
        elif s[0].isalpha():
            yield ('FUNC', s)
        elif s[0] == '[':
            yield ('COUNTER', s)
        elif s[0] in '+-*/':
            yield ('OPER', s)
        else:
            yield ('OTHER', s)

下面看看这个函数的运行过程:

首先创建的正则表达式,用多个 | 或符号分隔多种情况,包括:空格( +)、带小数点的数字([\d\.]+)、字母数字混合([A-Za-z_0-9]+)、小括号([\(\)])、四则运算符([\+\-\*\/]

finditer()返回一个迭代器,每次迭代返回的内容是一个 Match Object,Match Object 的 group() 函数返回分组的结果,参数为 0 时,返回完整的匹配结果。

接下来根据匹配内容的第一个字符来判断所属的类型:

各位读后有什么想法,请在下方留言吧!如果对本文有疑问或者寻求合作,欢迎 联系邮箱邮箱已到剪贴板

精彩评论