- 迎新快报“还缺什么”一栏依赖资源侧数字,今天填不了
- 当前版本不含对话式问数,前提是指标字典先收口
- 备份保留期三十天,不等于回顾所需的三到五年留存
- 参数分三层:网页可改、每届重设、随版本走
- 涉及学生身份的数据须留在本校,办事标准可成标准件
前三章讲的判断都发生在七天之内:卡点要今天处理,洪峰要明天用,线索要当晚推给该负责的人。第四类不一样,它发生在这一届结束到下一届开始之间的那段空档。
办过迎新的学校领导都清楚:项目组解散、学工口的经办人轮岗、带过两届的辅导员毕业去了别的单位、去年调好的那套时间段表存在某个人的聊天记录里。到来年三月新项目组重新拉起来的时候,唯一留下来的东西是系统里那批没人再翻的原始记录,和一份写给别人看的总结报告。
一届迎新最大的浪费,不是排队,是经验在下一届开学前蒸发干净。
这一章讲的四件事——快报、问数、回顾、回写——都是为了对抗这种蒸发。其中两件今天就在跑,两件的范围要照实说。
21.1 每日迎新快报:四栏内容,今天填得满几栏
报到那一周,几乎所有学校都在做同一件事:编一条当日进展发给校领导。多数时候这条消息由经办人晚上十点手工拼出来——白天在窗口处理业务,晚上统计数字。
一份能被用来做决定的快报,应该回答四件事:今天办到哪了、卡在哪、明天要来多少、还缺什么。 逐栏说现状。
进展:这一栏填得满。每一项任务的完成人数、按学院拆的完成率、大屏幕上那八个视角的数字,都是从同一份办理记录出来的,可以直接抄。要提防的是第十四章那个坑——同一句"完成率",两处算出来不一样。
卡点:这一栏能填到"哪一项、哪个学院、还差多少人、其中多少人打开过没办完"。填不到"因为什么",原因记录那三处缺口在第十八章逐条列过。
明日预计:这一栏填的是"已填报的人里明天预计到达多少",它不是明日的全量——填报覆盖度没算进来的话,这两者会被读成同一个数。这一栏最该配一句诚实的说明:"目前按已填行程的 X 人统计。"
还缺什么:这一栏今天填不了,因为它需要资源侧的数字——几个窗口、每小时办得了几件、几辆车、多少志愿者能到岗。这些不在系统里。一栏空着的快报,恰恰说明这一类能力卡在哪里:不是卡在读数据,是卡在学校的资源约束还没有被数字化。
21.2 自然语言问数:难点从来不是"能问",是"谁定的口径"
先说范围:当前版本不含对话式问数。 系统里没有任何自然语言查询能力,能问的对象只有筛选条件和八个视角。
这不是找借口回避新技术。问数的门槛不在问,在答。
行业里的公开进展值得认真看,不必回避。《数智迎新总览》(《中国教育网络》2025-09-29)里那批头部高校的实践中,有学校的新生问答服务了 7407 名新生、解答 5.3 万个问题,也有学校把往年的高频问题整理进知识库并每天补充;这些系统做到的是问答、跳转、联办与主动推送,业务动作仍然由人执行。"让对话替新生把迎新业务办完",业界至今没有实例。
而"用一句话问出一个统计数"这一层,比问答更难,难在三个具体问题:
第一,它答不出它没被教过的口径。 用户问"报到率多少",系统必须知道分母是录取数还是名册应到数。这个决定在第十四章里是写在指标字典里的,字典没建好之前接上模型,得到的只是把不一致的口径用极流利的中文说出来——比表格更危险,因为它听起来像结论。
第二,它会替没有责任人的数字背书。 报表上的每一个数,出错时都能追到那张报表的出处与取数时点;一句话问出来的数,出错时找不到任何东西可以追问。
第三,权限要在问的那一层生效。 院系经办人问"全校报到率"和"本院报到率",返回的不能是同一份数据。这条要求对接的是第八章那四层链路,不是提示词。
所以顺序应该是:指标字典收口 → 一组固定问题带标准答案的核对集 → 才谈问数。 学校判断任何一家产品的问数能力,也只需要问这一句:"这个数按什么口径算的,把依据出示给我看。" 答得出来的,才值得继续谈形态。
21.3 季末回顾:纵向对照今天能做,横向参照我们不给
回顾是每一届之后最该做、也最少被做的一件事——它通常被一份"迎新工作总结"替代,而那份总结里的数字,多数是临时从系统导出来手算的。
现在就能做的那一半:全部办理记录、行程、缴费、选宿、核验、审批都在同一份数据里留着,按学院、按任务、按时段回头切一遍是可行的。第十八章那套漏斗、第十九章那三张表,本质就是回顾的素材。
必须先补的那一半是数据的存续。 这里要分清两件极易混淆的事:备份保留期不是数据保留期。 系统当前的备份文件保留三十天,这是运维恢复用的;而回顾要的是三年、五年的历史数据完整留存。归档与保留期治理这一项,第十五章已经写明不在当前版本的能力范围内。没有保留期策略,回顾就只能回看到上一届。
同类校参照这一项,我们明确不给。 想要"和规模相近的学校比一比"是很自然的诉求,但要满足它,得把多所学校的报到、缴费、资助数据放进同一个池子并按同一套口径重算。这里面每一环都有问题:口径不一致(第十四章自己还没解决)、授权不明确(谁允许把学生办理数据拿去和别人比)、结果无法归因(完成率差十个百分点,是系统差别还是学校差别)。头部学校之间的横向比较,多数比的是领导讲话里的形容词。
能给的是自己和自己比:同一所学校、同一套口径、连续几届的曲线。这件事不需要任何外部授权,也不需要跨校数据池,而它对一次汇报的价值远高于一个含糊的平均值。参照系如果需要,教育部的年度事业发展统计公报里有校均招生规模这类公开数字可以用来说明"我们这所学校处在一个什么量级",但它不能用来评判某个学院的工作。
21.4 参数回写:能被留下的,是能被改的那批东西
沉淀听上去像一句口号,落到工程上是一句很朴素的话:上一届学到的东西,来年改一处配置就能生效,还是要找厂商改程序、重新上线一次。
系统里可改的东西分三层,逐层说清楚。
第一层,网页上就能改的运行配置。 这一层是"不改程序就能调整行为"的那部分,包括:学校名称与域名(影响页面标题与导出文件名)、统一登录的接入方式与服务地址、人员与组织同步的数据源类型、组织层级怎么解析成学院—专业—班级、同步取数的语句、同步的开关、间隔与每日执行时刻、允许访问的域名清单、登录令牌的有效期、验证码开关。这一层的价值常被低估——一所学校从"学籍表里那棵树"到"系统里的五级组织",中间的映射规则全在这一层里调,调一次管很多年。
第二层,每届都要重新设的业务参数。 批次的任务清单与每一项的起止时间窗、核验通过所需的比对分数阈值、体检的开放时段与容量、选宿的开放时间与改选次数、字典选项与须知内容。这些不需要写任何程序,但它们必须有人记得去改。"去年核验阈值定在八十分太松,今年收紧到八十五"这句话,今天只能靠人在配置里敲进去。
第三层,随产品版本走、学校改不了的。 限流的每秒请求数、登录连错五次锁半小时、核验失败十次转人工、后台任务超时上限。这些是安全与稳定性的兜底,写死是合理的,但必须像这一章这样白纸黑字告诉学校有哪些,不要让学校以为什么都能调。
"回写"这个词里我们不做的那一半也要说清:分析结果自动改配置,这件事系统不做,也不主张近期做。理由回到第二十章最后那条铁律——阈值一动,通过和拦截就同时变了,这是会影响学生权益的动作,做决定和签字的必须是自然人。 系统能把"去年这个时段被抢满、另外三个时段空着"算清楚摆出来,把改不改、改多少留给学校。
改进回路的关键不在自动化,在可追溯。 一次改动如果留得下"改了什么、为什么改、按哪个数据改的",来年的人就知道该不该再改一次——这正好是第十五章那条留痕链路要补齐的东西。没有留痕的回写,只是把去年的错误熟练地重复一遍。
21.5 与上级的数据要求衔接:把外部口径也当成参数存下来
每一届结束时,学校还有一件事要做:向上级报送。这一层的难度第十四章讲过——不在总量,在字段齐套与代号正确。
这里要补的是沉淀视角的一条:外部的口径是会变的,而变化本身需要被记录。 某项统计的分组方式换了一次、某个代号跟着上级文件改了写法、某类学生的填报要求增加一项——这些改动的当天没人觉得要留记录,一年后就没人说得清"我们为什么这一届和上届不一样"。
系统里民族与区划的归一处理已经在跑,但它是一处转换逻辑,不是一份带版本与生效时间的码表。把外部口径版本化(哪一套代号从哪一天起生效、报送格式按哪一年的要求)列在批次建设里。这件事做不做,决定三年后回头查时能不能看懂当年那张表。
21.6 什么能变成跨校的标准件,什么必须留在本校
这是四类判断能力走完之后的最后一个实质问题,也是学校最容易在会上被问住的一问。
能沉淀成标准件的,全是"怎么办事"的部分:任务体系本身(四种任务种类下的几十个任务类型)、任务的分组与先后关系、字段之间的映射位与导入导出的模板结构、权限码的分层方式、移动端那批自助功能点的集合、大屏各视角要展示什么、以及一整套实施节奏——首所学校、第五所、第十所分别需要多少工作量的那条曲线。这些东西换一所学校照样成立,所以它们才叫标准。
必须留在本校的,全是"谁"和"怎么办"的部分:名册和每一个人的全部数据、字典选项的具体取值、组织架构的真实层级、审批习惯与经办人分工、场地与接站安排、须知与帮助的具体内容、任何一份测评的量表与解释规则。这些是这一所学校的实际,出厂时不该带、出厂后也带不走。
一条判据可以直接拿去用:凡涉及"这所学校怎么办事"的,可以做成标准件;凡涉及"这个学生是谁"的,必须只存在这一所学校的库里。 第十四章的字典、第十三章的分级、第八章的权限码,合起来守的就是这条线。
沉淀的检验标准很朴素:下一届开学前,上一届学到的东西还在不在系统里,而不是在哪个人的手机里。 经验留在人身上是学校的损失,留在配置和字典里才是学校的资产——厂商会换,资产不该跟着一起换。