你是不是也遇到过这样的场景:
月底了,领导突然让你整理一份本月的工作日程回顾,用来写月报;或者你想把自己密密麻麻的会议安排导出来,做成一份清爽的 Markdown 笔记归档。
这时候,你打开企业微信,盯着屏幕上密密麻麻的日程块,陷入了沉思……😵💫
“难道要我一个个手动复制粘贴吗?”
别慌!今天这篇教程,就是来拯救你的。我们将利用 Python 和 CalDAV 协议,全自动、批量地把企业微信里的日历“扒”下来,并生成一份排版精美的 Markdown 文档。
💡 省流版: 本文包含完整的 Python 代码、避坑指南以及原理解析。即使你不懂代码,照着做也能搞定!
🛠️ 01. 准备工作:工欲善其事
在开始之前,你需要准备三样东西:
- Python 3.10+
- 企业微信桌面端
- 一点点耐心
为什么选择 CalDAV?
企业微信从 v5.0 开始支持 CalDAV 协议。简单来说,这是一个标准的日历同步协议,就像一把“万能钥匙”,允许第三方应用读取你的日历数据。我们就是利用这把钥匙,绕过繁琐的界面,直接获取底层数据。
🔑 02. 获取“钥匙”:CalDAV 账号信息
首先,我们需要拿到连接企业微信服务器的凭证。
你会看到三行关键信息,请记下来(或者截图):
| | |
|---|
| 账号 | | yourname@corp.wecom.work |
| 服务器 | | wecom.work |
| 密码 | | FggpM9... |
⚠️ 重要提示:这个密码是动态生成的!每次点击“获取密码”,旧密码就会立即失效。而且,实际连接时,服务器地址需要加上 caldav. 前缀,变成:https://caldav.wecom.work。
⚙️ 03. 环境搭建:安装依赖
打开你的终端(Terminal)或命令行,创建一个虚拟环境并安装我们需要用到的库:
# 创建虚拟环境python3 -m venv venvsource venv/bin/activate # Windows用户运行 venv\Scripts\activate# 安装依赖库pip install requests icalendar recurring-ical-events pytz
这些库是干嘛的?
requestsicalendarrecurring_ical_events
🧩 04. 核心原理:我们是如何做到的?
在写代码之前,简单了解一下流程,这样如果报错了你也知道去哪修。
企业微信的 CalDAV 服务器有点“个性”,不能完全照搬标准流程。我们的策略是:
- PROPFIND: 先问服务器“你有哪些日历?”(比如工作日历、个人日历)。
- PROPFIND (Depth:1): 再问“这个日历里有哪些
.ics 文件?”(每个文件代表一个事件)。 - GET: 把刚才列出来的
.ics 文件一个个下载下来。 - 解析与生成: 用 Python 把
.ics 里的乱码翻译成人类语言,最后写入 Markdown 文件。
💡 避坑预警: 为什么不用现成的 caldav 库?我试过,但企业微信的服务器对根路径返回 403 禁止访问,且 XML 响应存在命名空间 Bug。所以,直接用 requests 发送原始请求是最稳妥的方案。
💻 05. 完整代码实现
这是今天的重头戏。请复制以下代码,保存为 export_calendar.py。
记得修改代码顶部的 USERNAME 和 PASSWORD 为你刚才获取的信息!
#!/usr/bin/env python3"""企业微信日历导出工具通过 CalDAV 协议获取企业微信日历事件,导出为 Markdown 文件。"""import datetimeimport reimport requestsfrom requests.auth import HTTPBasicAuthfrom concurrent.futures import ThreadPoolExecutor, as_completedimport pytzfrom icalendar import Calendarimport recurring_ical_eventsimport os# ============ 配置区 ============# 👇 在这里填入你的账号和密码USERNAME = "your_account@yourcorp.wecom.work" PASSWORD = "your_calDav_password" BASE_URL = "https://caldav.wecom.work"OUTPUT_DIR = "~/Desktop" # 导出文件保存位置TIMEZONE = "Asia/Shanghai"# ================================def get_month_range(): """获取当月的时间范围""" today = datetime.date.today() month_start = today.replace(day=1) if today.month == 12: month_end = today.replace(year=today.year + 1, month=1, day=1) else: month_end = today.replace(month=today.month + 1, day=1) tz = pytz.timezone(TIMEZONE) start_dt = tz.localize(datetime.datetime.combine(month_start, datetime.time.min)) end_dt = tz.localize(datetime.datetime.combine(month_end, datetime.time.min)) return start_dt, end_dt, todaydef list_calendars(session): """Step 1: 列出所有日历""" resp = session.request( "PROPFIND", f"{BASE_URL}/calendar/", headers={"Content-Type": "application/xml", "Depth": "1"}, data="""<?xml version="1.0" encoding="utf-8"?> <propfind xmlns="DAV:" xmlns:caldav="urn:ietf:params:xml:ns:caldav"> <prop> <displayname/> <resourcetype/> </prop> </propfind>""", timeout=30, ) # 使用正则提取,避开XML命名空间Bug calendars = [] response_blocks = re.findall(r'<[^:]*?:response>(.*?)</[^:]*?:response>', resp.text, re.DOTALL) for block in response_blocks: if 'calendar' not in block.lower(): continue href_match = re.search(r'<[^:]*?:href>(.*?)</[^:]*?:href>', block, re.DOTALL) if not href_match: continue href = href_match.group(1).strip() name_match = re.search(r'<[^:]*?:displayname>(.*?)</[^:]*?:displayname>', block, re.DOTALL) name = name_match.group(1).strip() if name_match else href if href.endswith('/calendar/'): continue calendars.append({"href": href, "name": name}) return calendarsdef list_event_files(session, calendar_href): """Step 2: 列出日历下所有 .ics 文件""" cal_url = f"{BASE_URL}{calendar_href}" resp = session.request( "PROPFIND", cal_url, headers={"Content-Type": "application/xml", "Depth": "1"}, data="""<?xml version="1.0" encoding="utf-8"?> <propfind xmlns="DAV:" xmlns:caldav="urn:ietf:params:xml:ns:caldav"> <prop> <displayname/> <resourcetype/> <getcontenttype/> </prop> </propfind>""", timeout=30, ) ics_hrefs = re.findall(r'<[^:]*?:href>(/calendar/[^<]+\.ics)</[^:]*?:href>', resp.text) return ics_hrefsdef fetch_ics(session, href): """Step 3: 下载单个 .ics 文件""" url = f"{BASE_URL}{href}" try: r = session.get(url, timeout=15, headers={"Accept": "text/calendar"}) if r.status_code == 200 and 'BEGIN:VCALENDAR' in r.text: return r.text.strip() except Exception: pass return Nonedef parse_events(ical_data_list, start_dt, end_dt): """Step 4: 解析数据并展开重复事件""" tz = pytz.timezone(TIMEZONE) parsed_events = [] for ical_text in ical_data_list: try: ical = Calendar.from_ical(ical_text) # 展开重复事件 expanded = recurring_ical_events.of(ical).between(start_dt, end_dt) for component in expanded: if component.name != "VEVENT": continue # 提取基础信息 summary = str(component.get("summary", "(无标题)")) dtstart = component.get("dtstart") dtend = component.get("dtend") location = str(component.get("location", "")) if component.get("location") else "" description = str(component.get("description", "")) if component.get("description") else "" status = str(component.get("status", "")) if component.get("status") else "" # 处理参与者和组织者 attendees_raw = component.get("attendee", []) if not isinstance(attendees_raw, list): attendees_raw = [attendees_raw] attendee_list = [str(a.params.get("cn", str(a))) for a in attendees_raw if hasattr(a, "params")] organizer = component.get("organizer") organizer_str = str(organizer.params.get("cn", str(organizer))) if organizer and hasattr(organizer, "params") else "" parsed_events.append({ "summary": summary, "dtstart": dtstart.dt if dtstart else None, "dtend": dtend.dt if dtend else None, "location": location, "description": description, "attendees": attendee_list, "organizer": organizer_str, "status": status, }) except Exception: continue # 排序 def sort_key(e): ds = e["dtstart"] if ds is None: return datetime.datetime.min.replace(tzinfo=tz) if isinstance(ds, datetime.datetime): if ds.tzinfo is None: ds = tz.localize(ds) return ds return datetime.datetime.combine(ds, datetime.time.min).replace(tzinfo=tz) parsed_events.sort(key=sort_key) return parsed_eventsdef generate_markdown(events, today): """Step 5: 生成 Markdown""" tz = pytz.timezone(TIMEZONE) weekday_names = ["一", "二", "三", "四", "五", "六", "日"] lines = [] lines.append(f"# 企业微信日历 — {today.year}年{today.month}月\n") lines.append(f"> 导出时间: {datetime.datetime.now().strftime('%Y-%m-%d %H:%M')}\n") lines.append(f"> 事件总数: {len(events)}\n") if not events: lines.append("\n*本月暂无日历事件。*\n") return "\n".join(lines) current_date = None for ev in events: ds = ev["dtstart"] if ds is None: continue # 时间格式化 if isinstance(ds, datetime.datetime): ds_date = ds.astimezone(tz).date() ds_str = ds.astimezone(tz).strftime("%H:%M") else: ds_date = ds ds_str = "全天" de = ev["dtend"] de_str = de.astimezone(tz).strftime("%H:%M") if isinstance(de, datetime.datetime) else "全天" if de else "" # 日期分组 if ds_date != current_date: current_date = ds_date weekday = weekday_names[ds_date.weekday()] lines.append(f"\n## {ds_date.strftime('%Y-%m-%d')} 星期{weekday}\n") time_range = "全天" if ds_str == "全天" and (not de_str or de_str == "全天") else f"{ds_str} - {de_str}" lines.append(f"### {ev['summary']}\n") lines.append(f"- **时间**: {time_range}\n") if ev["status"]: lines.append(f"- **状态**: {ev['status']}\n") if ev["location"]: lines.append(f"- **地点**: {ev['location']}\n") if ev["organizer"]: lines.append(f"- **组织者**: {ev['organizer']}\n") if ev["attendees"]: lines.append(f"- **参与者**: {', '.join(ev['attendees'])}\n") if ev["description"]: lines.append(f"- **描述**:\n\n {ev['description'].strip()}\n") lines.append("") return "\n".join(lines)def main(): session = requests.Session() session.auth = HTTPBasicAuth(USERNAME, PASSWORD) start_dt, end_dt, today = get_month_range() print(f"📅 导出范围: {today.year}年{today.month}月") # 1. 获取日历列表 print("\n📂 正在获取日历列表...") calendars = list_calendars(session) for cal in calendars: print(f" - {cal['name']}") # 2. 获取所有事件文件链接 print("\n📋 正在列出事件文件...") all_ics_hrefs = [] for cal in calendars: ics_hrefs = list_event_files(session, cal["href"]) all_ics_hrefs.extend(ics_hrefs) print(f" 共计发现: {len(all_ics_hrefs)} 个事件文件") # 3. 并发下载 (提速关键) print("\n⬇️ 正在下载事件数据...") all_ical_data = [] with ThreadPoolExecutor(max_workers=20) as executor: futures = {executor.submit(fetch_ics, session, h): h for h in all_ics_hrefs} for future in as_completed(futures): result = future.result() if result: all_ical_data.append(result) print(f" 成功下载: {len(all_ical_data)} 个事件") # 4. 解析 print("\n🔎 正在解析事件...") events = parse_events(all_ical_data, start_dt, end_dt) # 5. 生成文件 print("\n📝 正在生成 Markdown...") markdown = generate_markdown(events, today) output_path = os.path.expanduser(f"{OUTPUT_DIR}/企业微信日历_{today.year}年{today.month}月.md") with open(output_path, "w", encoding="utf-8") as f: f.write(markdown) print(f"\n✅ 导出完成: {output_path}")if __name__ == "__main__": main()
🚧 06. 踩坑记录:我替你趟过的雷
在开发这个脚本时,我遇到了不少企业微信服务器的“奇葩”设定,如果你运行报错,可以对照看看:
- 403 Forbidden 错误
- 原因:企业微信的 CalDAV 根路径是锁住的,不能直接访问。
- 解决:代码中我们直接硬编码了
/calendar/ 路径,不要试图去请求根目录。
- XML 解析报错
- 原因:服务器返回的 XML 命名空间前缀混乱(一会是
D: 一会是 A:),标准解析器会崩溃。 - 解决:放弃 XML 解析库,直接用 正则表达式 提取
href 和 displayname,简单粗暴但有效。
- 下载速度极慢/超时
- 原因:如果你的日历里有上百个会议,串行下载(一个一个下)会非常慢,甚至被系统杀掉进程。
- 解决:代码中使用了
ThreadPoolExecutor 进行多线程并发下载,速度提升了 10 倍以上!
📝 07. 注意事项
- 安全性:代码里的密码是明文写的。如果你要把代码传到 GitHub,千万记得删掉密码,改用环境变量读取。
- 密码有效期:企业微信的 CalDAV 密码会过期。如果某天脚本突然跑不通了,记得去企业微信里重新点一下“获取密码”。
- 时区:代码默认使用了
Asia/Shanghai,如果你在海外,记得修改时区配置。
🚀 08. 进阶玩法
如果你觉得导出 Markdown 还不够酷,可以尝试:
- 导出为 ICS:修改代码,把所有事件合并成一个
.ics 文件,这样你就可以把企业微信日程“搬家”到 Google Calendar 或 Apple Calendar 了。 - 定时任务:配合 macOS 的
cron 或 Windows 的任务计划程序,设置每月 1 号自动导出上月日程,从此告别手动整理月报!
希望这篇教程能帮你从繁琐的日程整理中解脱出来,把时间花在更有价值的事情上!☕️
如果你觉得有用,欢迎点赞、在看、转发三连!