Python 的入门曲线是公认的平缓——几行代码就能跑通一个脚本。但写过上万行生产代码之后你会发现:真正拉开开发者水平的,不是"能不能实现某个功能",而是"面对同一个问题,你选哪种写法"。
写得少,不等于写得好。
这篇文章从日常编码的高频场景出发,精选 10 条实用技巧。每条都给出"常见但不够好的写法"和"更 Pythonic 的写法"的对比,方便直接对照改进。
技巧一:列表推导式(List Comprehension)
场景:从一个列表中筛选并转换元素。
不推荐的写法:
result = []for x in range(10): if x % 2 == 0: result.append(x * x)
推荐写法:
result = [x * x for x in range(10) if x % 2 == 0]
一条规则:单层条件 + 单层循环的场景用推导式,可读性和性能都优于显式 for 循环。需要留意的是,嵌套超过两层时推导式的可读性会急剧下降,此时应退回普通 for 循环。
dict 和 set 同样支持推导式:
squares = {x: x * x for x in range(5)}
技巧二:用 enumerate() 替代 range(len())
场景:遍历列表时同时需要索引和元素值。
不推荐的写法:
for i in range(len(items)): print(f"{i}: {items[i]}")
推荐写法:
for i, item in enumerate(items): print(f"{i}: {item}")
enumerate() 还支持 start 参数,当你需要索引从 1 开始时:
for i, item in enumerate(items, start=1): print(f"第{i}项: {item}")
这条技巧本身很简单,但在 code review 中 range(len()) 的出现频率高得惊人。改掉它,代码立刻少了一层间接访问。
技巧三:zip() 并行迭代
场景:同时遍历多个等长(或不等长)序列。
不推荐的写法:
for i in range(len(names)): print(names[i], scores[i])
推荐写法:
for name, score in zip(names, scores): print(name, score)
当两个序列长度不一致时,默认 zip() 按最短的来。如果需要对不齐的部分也处理,用 itertools.zip_longest:
from itertools import zip_longestfor name, score in zip_longest(names, scores, fillvalue=None): print(name, score)
技巧四:f-string——格式化字符串的首选
场景:拼接变量到字符串中。
不推荐的写法:
msg = "User {} has score {:.2f}".format(name, score)msg = "User %s has score %.2f" % (name, score)
推荐写法:
msg = f"User {name} has score {score:.2f}"
f-string(Python 3.6+)的优势不止于简洁。花括号内可以写任意表达式:
f"Next year: {year + 1}"f"Status: {'active' if user.is_active else 'inactive'}"f"Data: {data!r}" # 输出 repr 形式
调试时还有一个极少人用但极好用的技巧——= 说明符(Python 3.8+):
x = 42print(f"{x=}") # 输出: x=42print(f"{x * 2=}") # 输出: x * 2=84
技巧五:defaultdict 与 Counter
场景:对列表做分组或计数。
不推荐的写法(手动检查 key 是否存在):
groups = {}for item in items: key = item.category if key not in groups: groups[key] = [] groups[key].append(item)
推荐写法:
from collections import defaultdictgroups = defaultdict(list)for item in items: groups[item.category].append(item)
计数场景用 Counter 更直接:
from collections import Counterword_counts = Counter(words)top3 = word_counts.most_common(3)
Counter 本质是 defaultdict(int) 的封装,额外提供了 most_common()、subtract() 等方法,在词频统计、库存盘点等场景可以省掉大量样板代码。
技巧六:解包运算符 * 与 **
场景:列表/字典的合并、函数动态传参。
combined = [*list1, *list2, *list3]merged = {**dict1, **dict2}merged = dict1 | dict2def greet(name, age): ...person = {"name": "Alice", "age": 30}greet(**person)
函数定义中用 * 收集多余的位置参数,** 收集多余的关键字参数:
def log(message, *args, **kwargs): print(f"[LOG] {message}", args, kwargs)log("connection", "timeout", host="db.local", port=5432)
技巧七:上下文管理器——不只是 open()
场景:资源需要在使用后可靠释放(文件、数据库连接、锁等)。
标准姿势你肯定熟悉:
with open("data.txt") as f: content = f.read()
但很多人不知道可以自己实现上下文管理器。两种方式:
方式一:实现 __enter__ / __exit__:
class Timer: def __enter__(self): self.start = time.perf_counter() return self def __exit__(self, *args): self.elapsed = time.perf_counter() - self.startwith Timer() as t: do_heavy_work()print(f"耗时: {t.elapsed:.3f}s")
方式二:用 contextlib.contextmanager 装饰器(更简洁):
from contextlib import contextmanager@contextmanagerdef temporary_change(obj, attr, value): original = getattr(obj, attr) setattr(obj, attr, value) try: yield finally: setattr(obj, attr, original)
任何需要"进入—操作—无论如何都要退出"的模式都适用。__exit__ 返回 True 还可吞掉异常,这在某些重试场景下有用。
技巧八:lambda 与 map / filter 的取舍
场景:对可迭代对象做映射或过滤。
numbers = [1, 2, 3, 4, 5]squared = list(map(lambda x: x * x, numbers))evens = list(filter(lambda x: x % 2 == 0, numbers))
但这里有一条明确的取舍建议:如果表达式简单到一行,推导式更 Pythonic。
squared = [x * x for x in numbers] # 优于 map + lambdaevens = [x for x in numbers if x % 2 == 0] # 优于 filter + lambda
lambda 的真正价值在于作为回调传入高阶函数的场景,比如 sorted(key=lambda x: x.age)、max(iterable, key=lambda ...)。那种情况下它比单独定义一个一次性函数干净得多。
技巧九:pathlib——告别 os.path
场景:文件路径操作。
不推荐的写法:
import osbase = "/data/project"filepath = os.path.join(base, "reports", "2026", "summary.csv")dirname = os.path.dirname(filepath)filename = os.path.basename(filepath)stem, ext = os.path.splitext(filename)
推荐写法:
from pathlib import Pathfilepath = Path("/data/project") / "reports" / "2026" / "summary.csv"dirname = filepath.parent # Path对象filename = filepath.name # 'summary.csv'stem = filepath.stem # 'summary'ext = filepath.suffix # '.csv'
pathlib 的面向对象设计让路径操作变得更直观。还有一些额外好处:
text = Path("data.txt").read_text(encoding="utf-8")Path("output.txt").write_text(text, encoding="utf-8")for py_file in Path("src").rglob("*.py"): print(py_file)if filepath.exists() and filepath.is_file(): ...
从 Python 3.6 起,os 模块的大部分函数已经接受 Path 对象,open() 也直接支持。新项目建议统一用 pathlib,一致性远胜于混用。
技巧十:类型标注 type hints
场景:让函数签名自带文档,让 IDE 和静态检查工具帮你发现类型错误。
from typing import Optionaldef get_user(user_id: int) -> Optional[dict]: """返回用户信息,不存在时返回 None。""" ...
更复杂的例子——泛型容器:
from collections.abc import Sequencedef average(values: Sequence[float]) -> float: if not values: raise ValueError("values must be non-empty") return sum(values) / len(values)
类型标注本身不影响运行时行为,但配合 mypy 做静态检查,能在提交前拦截大量低级错误:
pip install mypymypy src/
几个实践中沉淀下来的建议:
- 复杂类型用
TypeAlias(Python 3.12+)或直接声明为 type 变量,避免签名过长。 Any 是逃生舱,但用多了等于没标——优先用 object 或 Protocol。- 团队层面配一个 pre-commit hook 跑
mypy,零成本强制执行。
收尾
这 10 个技巧覆盖从"一句话改进"到"工程习惯养成"的梯度。没必要一次性全改——那样反而容易写出用力过猛的代码。建议先挑 2-3 条高频场景(比如 f-string、enumerate、类型标注)在日常编码中刻意练习,一个月后再回头看旧代码,你能直观感受到差距。
选技原则总结起来就一句话:可读性优先,善用标准库。