材料够写一期短日报:只留能拆到输入、复核和输出物的条目。
本期只保留能拆到输入、复核和输出物的材料。其余板块不硬凑。
今日最值得落地(2条)
1. 费用 Agent 上线前:先造一条会失败的报销数据,不要让它自测自过
- 场景:费用/报销试点。对象是上线前验收,不是自动付款。
- 可做动作:先写死一组互相挂钩的业务数据,再用同一组数据把流程跑通。公开例子是:市场部李明,部门年预算 50 万、已用 32 万;6 月 15 日深圳出差 3 晚,住宿 2,400、交通 860、餐饮补贴 300。住宿是完整电子票,交通是模糊照片,餐饮无票走补贴。6 月 10 日已有同一酒店、同一天的住宿票。加上这 3,560 元后,差旅科目已用 4.8 万、超标;公司规则是超 3,000 要部门负责人批、超 5,000 财务总监加签。本周不要让模型“自己测自己”。你只准备这组数据,看它在每个环节有没有传对。
- 复核控制:费用会计按检查点签字,缺一项就停。至少看:费用类型是否差旅、金额是否仍是 3,560、模糊票是否标“需人工核对”、无票是否走私贴而不是强行要票、重复住宿票是否拦住、超 3,000 是否送到部门负责人而不是直属上级、预算超限是否禁止自动付款。模型不得改预算、不得改审批人、不得付款。
- 输出物:一条端到端测试数据包;检查点对错表;拦截/放行日志;费用会计签字栏。
- 来源:手搓财务智能体(35):UAT 方法测试系统(中文实操方法文,不是某家财务团队的现场审计结论;来源页面显示 2026-07-02)
2. 上会模型先写清:AI 做了哪一步、人改了什么假设
- 场景:情景测算、财务模型、给管理层的数字。对象是披露和抽查,不是让模型自己选通胀、利率或成本假设。
- 可做动作:本周每一份要上会的模型附一页。只写三句:AI 用在哪一步(取数、勾稽、敏感性、叙事);人做了什么检查;通胀、利率、单位成本是谁定的。Financial Modeling Institute 执行董事 Ian Schnoor 2026-08-24 对媒体的口径是:CFO 要能回答“AI 用了多少、人做了什么”;早期阶段 CFO 自己做抽查和压力测试,因为流程还没定型,不能把错漏留给 Agent。
- 复核控制:关键假设必须有人名。模型不得自行选定通胀、利率、成本。CFO 或 FP&A owner 抽查 1 个关键驱动项,改输入后看输出是否跟着变;变不动或说不清,这版不上会。
- 输出物:AI 使用披露页;假设责任表;CFO 抽查记录。
- 来源:CFO Dive:FMI 谈财务模型里的 AI 披露(培训/认证机构负责人访谈,不是某家公司内部底稿;发布日期:2026-08-24)
Accounting / Close / Controls
见今日最值得落地第 1 条。
输入是员工、部门预算、发票、历史票、审批阈值;模型只跑抽取、重复票、预算超限、审批路由;人只确认数据有没有传错。付款、改预算、改审批人仍走现有权限。扩大范围的条件只有一个:同一组数据连续两次跑,检查点结果一致,且费用会计认得出每一处红灯。
FP&A / Planning / Reporting
见今日最值得落地第 2 条。
先出假设责任表,再出情景数字。叙事可以让模型起草,数字和驱动项必须能指到表里的单元格和签字人。本期没有未在近几日出现过、且能落到 BvA 底稿字段的新案例。
Treasury / Cash / Risk
数据暂缺。 本期未发现最近 365 天内、同时具备公开正文和可复用步骤的现金预测、银行流水监控或 DSO/O2C 新案例。
Tax / Compliance / Audit
数据暂缺。 本期未发现最近 365 天内税务研究、SOX/内控或审计证据管理的新 AI 落地案例或实操方法。
CFO / Leader 团队建设经验
见今日最值得落地第 2 条。
可直接借用的组织动作只有这些:上会材料默认带“AI 用在哪 / 人查了什么 / 假设谁定”;CFO 自己抽 1 个驱动项做压力测试,不要只听汇报;信任仍来自人把结论交给另一个人,而不是模型自己说算对了。公开材料没有独立的财务编制替代数字。
LinkedIn 数据暂缺/认证未通。本期没有可交叉验证的 startup 财务编制替代案例。
开源 / AI 工程可借鉴
1. 先用固定 AR/AP 题集验收“问数”,不要让通用模型直接连生产账
- 场景:业务或财务问客户应收、逾期应付、现金折扣、催收级别。适合当只读问数的验收骨架。
- 可做动作:微软公开的 FinanceBenchmark 把题分成三类。你们本周只用第一类:内部 AP/AR。题必须带截止日期和主体,例如“截至某日某客户未收余额”“某主体逾期应付合计”“某供应商当前发票有没有现金折扣”。Agent 只能通过 MCP 查账套,回答必须落到客户/供应商、金额、账龄或付款状态,并指向源记录。公开仓库还带推理、打分、对比脚本;7 star,是官方评测仓,不是生产核算系统。后两类是上市公司财报研究,本周不要做。
- 复核控制:只接沙箱或脱敏导出。超时、答不出源记录、日期对不上,记失败,不计部分分。任何人不得写回发票、不得改账龄、不得付款。
- 输出物:10 道本团队 AR/AP 只读题;对错表;失败原因(超时 / 无引用 / 日期错 / 金额错)。
- 来源:GitHub:microsoft/FinanceBenchmark(官方评测仓 / 低 star;题面使用 2026-03 示例日期,页面未另标最近推送日)
待验证线索
- 一家 WooCommerce/Shopify 插件公司创始人说,把每月约 1,000 笔 Xero 对账从会计师改成自己训练的 AI,“目前结果完美”;有人追问怎么做,未见字段、匹配规则或复核人。X:KatieKeithBarn2(2026-08-19;单源社媒 / 待验证)
本周可做的小实验
- 一条差旅单,专门用来找错:按第 1 条造数据,必须包含模糊票、重复住宿票、预算超限。费用会计只看检查点,不看模型自评。任一处该红不红,本周不接第二家供应商。
- 一份上会模型的披露页:选本周要讨论的 1 个情景。FP&A 填:AI 做了哪一步、人改了哪个假设、通胀/利率/成本谁定。CFO 改一个驱动项,看表是否跟着变。说不清就不上会。
- 3 道 AR 只读题,禁止写回:导出已关账的 3 个客户应收。人先写出截至日、客户、金额。模型只许回答这三项并指出源行。对不上作废。任何人不得过账、不得发催款。