当前位置:首页>python>Python 编程进阶:10 个提升代码效率与可读性的实用技巧

Python 编程进阶:10 个提升代码效率与可读性的实用技巧

  • 2026-10-11 05:44:22
Python 编程进阶:10 个提升代码效率与可读性的实用技巧

Python 的入门曲线是公认的平缓——几行代码就能跑通一个脚本。但写过上万行生产代码之后你会发现:真正拉开开发者水平的,不是"能不能实现某个功能",而是"面对同一个问题,你选哪种写法"。

写得少,不等于写得好。

这篇文章从日常编码的高频场景出发,精选 10 条实用技巧。每条都给出"常见但不够好的写法"和"更 Pythonic 的写法"的对比,方便直接对照改进。

技巧一:列表推导式(List Comprehension)

场景:从一个列表中筛选并转换元素。

不推荐的写法:

result = []for x in range(10):    if x % 2 == 0:        result.append(x * x)

推荐写法:

result = [x * x for x in range(10) if x % 2 == 0]

一条规则:单层条件 + 单层循环的场景用推导式,可读性和性能都优于显式 for 循环。需要留意的是,嵌套超过两层时推导式的可读性会急剧下降,此时应退回普通 for 循环。

dict 和 set 同样支持推导式:

squares = {x: x * x for x in range(5)}

技巧二:用 enumerate() 替代 range(len())

场景:遍历列表时同时需要索引和元素值。

不推荐的写法:

for i in range(len(items)):    print(f"{i}: {items[i]}")

推荐写法:

for i, item in enumerate(items):    print(f"{i}: {item}")

enumerate() 还支持 start 参数,当你需要索引从 1 开始时:

for i, item in enumerate(items, start=1):    print(f"第{i}项: {item}")

这条技巧本身很简单,但在 code review 中 range(len()) 的出现频率高得惊人。改掉它,代码立刻少了一层间接访问。

技巧三:zip() 并行迭代

场景:同时遍历多个等长(或不等长)序列。

不推荐的写法:

for i in range(len(names)):    print(names[i], scores[i])

推荐写法:

for name, score in zip(names, scores):    print(name, score)

当两个序列长度不一致时,默认 zip() 按最短的来。如果需要对不齐的部分也处理,用 itertools.zip_longest:

from itertools import zip_longestfor name, score in zip_longest(names, scores, fillvalue=None):    print(name, score)

技巧四:f-string——格式化字符串的首选

场景:拼接变量到字符串中。

不推荐的写法:

msg = "User {} has score {:.2f}".format(name, score)msg = "User %s has score %.2f" % (name, score)

推荐写法:

msg = f"User {name} has score {score:.2f}"

f-string(Python 3.6+)的优势不止于简洁。花括号内可以写任意表达式:

f"Next year: {year + 1}"f"Status: {'active' if user.is_active else 'inactive'}"f"Data: {data!r}"  # 输出 repr 形式

调试时还有一个极少人用但极好用的技巧——= 说明符(Python 3.8+):

x = 42print(f"{x=}")   # 输出: x=42print(f"{x * 2=}")  # 输出: x * 2=84

技巧五:defaultdict 与 Counter

场景:对列表做分组或计数。

不推荐的写法(手动检查 key 是否存在):

groups = {}for item in items:    key = item.category    if key not in groups:        groups[key] = []    groups[key].append(item)

推荐写法:

from collections import defaultdictgroups = defaultdict(list)for item in items:    groups[item.category].append(item)

计数场景用 Counter 更直接:

from collections import Counterword_counts = Counter(words)top3 = word_counts.most_common(3)

Counter 本质是 defaultdict(int) 的封装,额外提供了 most_common()、subtract() 等方法,在词频统计、库存盘点等场景可以省掉大量样板代码。

技巧六:解包运算符 * 与 **

场景:列表/字典的合并、函数动态传参。

combined = [*list1, *list2, *list3]merged = {**dict1, **dict2}merged = dict1 | dict2def greet(name, age):    ...person = {"name": "Alice", "age": 30}greet(**person)

函数定义中用 * 收集多余的位置参数,** 收集多余的关键字参数:

def log(message, *args, **kwargs):    print(f"[LOG] {message}", args, kwargs)log("connection", "timeout", host="db.local", port=5432)

技巧七:上下文管理器——不只是 open()

场景:资源需要在使用后可靠释放(文件、数据库连接、锁等)。

标准姿势你肯定熟悉:

with open("data.txt") as f:    content = f.read()

但很多人不知道可以自己实现上下文管理器。两种方式:

方式一:实现 __enter__ / __exit__:

class Timer:    def __enter__(self):        self.start = time.perf_counter()        return self    def __exit__(self, *args):        self.elapsed = time.perf_counter() - self.startwith Timer() as t:    do_heavy_work()print(f"耗时: {t.elapsed:.3f}s")

方式二:用 contextlib.contextmanager 装饰器(更简洁):

from contextlib import contextmanager@contextmanagerdef temporary_change(obj, attr, value):    original = getattr(obj, attr)    setattr(obj, attr, value)    try:        yield    finally:        setattr(obj, attr, original)

任何需要"进入—操作—无论如何都要退出"的模式都适用。__exit__ 返回 True 还可吞掉异常,这在某些重试场景下有用。

技巧八:lambda 与 map / filter 的取舍

场景:对可迭代对象做映射或过滤。

numbers = [1, 2, 3, 4, 5]squared = list(map(lambda x: x * x, numbers))evens = list(filter(lambda x: x % 2 == 0, numbers))

但这里有一条明确的取舍建议:如果表达式简单到一行,推导式更 Pythonic。

squared = [x * x for x in numbers]          # 优于 map + lambdaevens = [x for x in numbers if x % 2 == 0]  # 优于 filter + lambda

lambda 的真正价值在于作为回调传入高阶函数的场景,比如 sorted(key=lambda x: x.age)、max(iterable, key=lambda ...)。那种情况下它比单独定义一个一次性函数干净得多。

技巧九:pathlib——告别 os.path

场景:文件路径操作。

不推荐的写法:

import osbase = "/data/project"filepath = os.path.join(base, "reports", "2026", "summary.csv")dirname = os.path.dirname(filepath)filename = os.path.basename(filepath)stem, ext = os.path.splitext(filename)

推荐写法:

from pathlib import Pathfilepath = Path("/data/project") / "reports" / "2026" / "summary.csv"dirname = filepath.parent          # Path对象filename = filepath.name           # 'summary.csv'stem = filepath.stem               # 'summary'ext = filepath.suffix              # '.csv'

pathlib 的面向对象设计让路径操作变得更直观。还有一些额外好处:

text = Path("data.txt").read_text(encoding="utf-8")Path("output.txt").write_text(text, encoding="utf-8")for py_file in Path("src").rglob("*.py"):    print(py_file)if filepath.exists() and filepath.is_file():    ...

从 Python 3.6 起,os 模块的大部分函数已经接受 Path 对象,open() 也直接支持。新项目建议统一用 pathlib,一致性远胜于混用。

技巧十:类型标注 type hints

场景:让函数签名自带文档,让 IDE 和静态检查工具帮你发现类型错误。

from typing import Optionaldef get_user(user_id: int) -> Optional[dict]:    """返回用户信息,不存在时返回 None。"""    ...

更复杂的例子——泛型容器:

from collections.abc import Sequencedef average(values: Sequence[float]) -> float:    if not values:        raise ValueError("values must be non-empty")    return sum(values) / len(values)

类型标注本身不影响运行时行为,但配合 mypy 做静态检查,能在提交前拦截大量低级错误:

pip install mypymypy src/

几个实践中沉淀下来的建议:

  • 函数签名必标,内部变量按需标。
  • 复杂类型用 TypeAlias(Python 3.12+)或直接声明为 type 变量,避免签名过长。
  • Any
     是逃生舱,但用多了等于没标——优先用 object 或 Protocol。
  • 团队层面配一个 pre-commit hook 跑 mypy,零成本强制执行。

收尾

这 10 个技巧覆盖从"一句话改进"到"工程习惯养成"的梯度。没必要一次性全改——那样反而容易写出用力过猛的代码。建议先挑 2-3 条高频场景(比如 f-string、enumerate、类型标注)在日常编码中刻意练习,一个月后再回头看旧代码,你能直观感受到差距。

选技原则总结起来就一句话:可读性优先,善用标准库。

最新文章

随机文章