本页说明 Stats4U 在何处使用语言模型、该模型可以看到和做些什么,以及其中哪些内容受《条例》(EU) 2024/1689(《人工智能法》)规范。
概要
语言模型只出现在唯一一个地方:某个计数器公开统计页面顶部关于其走势的两三句话。别处都没有。
该模型运行在运营者自己的第二台机器上,而不是云服务商那里。不调用任何模型厂商的服务。只有统计页面上本来就公开的数字才会送给它。
模型什么都不决定。它只是措辞。它句子里的每一个数字都是交给它的,而且每一个数字事后都会核对;句子若站不住脚,就丢弃。
尚未完成的事项也写在这里:目前还没有第 50 条第 2 款所要求的、对生成句子的机器可读标记。原因见第 11 条。
本页是信息,而非法律意见。它陈述的是运营者本人的判断,未经任何机关或律师审阅。
1. 为什么会有这一页
《人工智能法》并不要求这样一页。它要求的是在生成文本出现的地方作出说明——而说明就在那里:每个方框下方,用页面的语言写着。
本页是自愿的,而且走得更远。它还说明哪些地方没有人工智能参与(第 6 条)、运营者在该条例下是什么角色(第 8 条),以及还缺什么(第 11 条)。对一个访客计数器来说,更常见的问题不是模型做了什么,而是究竟有没有在计数。
这是信息而非法律意见。需要对自己情况作法律判断的人,应当找愿意为此负责的人。
2. 唯一的那个地方
在计数器统计页面的顶部,可能有一个含两三句话的方框:哪一天是一周中最多的、访客来自多少个国家、最近几天与之前几天相比如何。这些句子是语言模型写的。
方框上就这么写着。 一行用页面语言写的文字说明:这段文字由语言模型依据旁边的实测数字写成,其中没有任何数字来自模型;旁边还标着模型名称和日期。那就是第 50 条要求的说明——它属于那段文字,而不属于本页。
大多数时候那里什么也没有。 只有在三十天内测得足够多时,计数器才会得到句子,而这里大多数计数器都在该门槛之下。这种情况有多常见,会被统计并公布在博客上。
这个方框只出现在本来就公开的统计页面上。设为私密的计数器和用密码保护的计数器不会有。
3. 哪个模型,在哪里计算
运营者不开发任何模型。他从第三方下载开放的模型权重,并原样运行。某个句子由哪个模型写成,标注在该句下方——写在那里而不写在这里,是因为模型可能更换,法律文本里的名字届时就会不实。
这些模型通过本地模型服务器运行在运营者的第二台机器上。与任何模型厂商都没有接口——没有任何内容传送到 OpenAI、Google、Anthropic、Mistral 或其他服务,也没有任何内容从那里回来。
使用第二台机器的原因是计算时间,而不是数据保护:模型每次作答需要数秒,而本应用中最重的查询只需毫秒。二者不该放在同一台机器上。测量结果在博客上。
没有训练,也没有微调。 权重保持下载时的样子。没有任何计数器数据进入任何训练,无论是运营者的还是他人的。
4. 模型能看到什么
只有单个计数器的已汇总数字,以及它所在网站的地址:最近几天与之前几天的访客对比、最多国家所占的比例、国家数量、一周中最多的一天、访问最多的子页面、设备占比。
没有 IP 地址。没有访客标识符。没有原始数据。 没有任何可归属到具体个人的东西。这个系统里本来就不存在描述某一次访问的记录。
而且只限于统计页面本身公开的计数器。这个条件写在分派任务处的代码里——不是稍后展示时才判断。没有它,整件事就成了把他人的数据转到第二台设备上。
因此第二台机器不会知道任何统计页面访客读不到的内容。同样的说明见隐私政策第 5.10 条。
5. 模型可以做什么,不可以做什么
它可以措辞。仅此而已。
选择由服务器完成:哪个数字值得一提,由代码计算并决定。模型每个事实收到一个任务,据此写出一句话。它从不同时看到两个事实。
回到服务器后,句子中的每一串数字都会与任务比对。若任务中没有,句子即被丢弃。名称——星期几、国家、设备、页面——同样会核对:该出现的必须出现,可能与之混淆的则不得出现。
模型不计算、不取整、不筛选,也不作任何决定。它不对任何人作出决定,不评价任何人,不阻止任何事,既不影响计数,也不影响所显示的数字。
这些检查抓不到的情况属于同一段:一句不用数字却说了假话的句子,以及一句主题与其事实不符的句子。两者都写在该写的地方,也就是博客上。自以为滴水不漏的检查,比一个明说了其缺口的检查更糟。
6. 哪些地方没有人工智能参与
对访客计数器而言这是更常见的问题,所以答案写在这里,而不是写在小字里:
- 计数本身——一次数据库查询和多出的一行。没有模型。
- 自动访问(「机器人」)的识别——把浏览器标识与一份字符串清单比对。没有学习程序,没有估计,也没有对人的评价。
- 由 IP 地址判定来源——一张地址段对照表。查出来的,不是猜的。
- 计数器图片、图表、每周来信、月度报告——由代码根据数字生成。
- 排除自己的访问、找回计数器、删除计数器——固定规则,可读且可重复。
任何地方都不存在 GDPR 第 22 条意义上针对个人的自动化决策,也没有用户画像。同样的说明见隐私政策第 11 条。
7. 本站上的第三方服务
统计页面上投放 Google 的广告,咨询表单则由 Google reCAPTCHA 防范自动提交。那里是否使用了受《人工智能法》规范的方法,由 Google 而非运营者决定;提供者的义务由该提供者承担。
就这些服务而言,运营者至多是第 3 条第 4 项意义上的部署者,而不是提供者。他没有用它们生成内容,也没有用它们对任何人作出决定。哪些服务被嵌入、用于什么,见隐私政策第 5 条和第 6 条。
8. Stats4U 在《人工智能法》下是什么角色
该条例区分提供者(第 3 条第 3 项)——开发 AI 系统或委托开发,并以自己的名义或商标将其投放市场或投入使用者,无论有偿或无偿——与在自己权限下使用 AI 系统的部署者(第 3 条第 4 项)。
按运营者的判断,他在这里两者皆是。围绕第三方模型的是一套自建系统:数字的选择、每个事实一个任务、答案的核对、结果的展示。他以自己的名义在自己的网站上把该系统投入使用——这是提供者的角色——并在自己的权限下使用它——这是部署者的角色。它不交给任何人,并不改变这一点:为自用而投入使用同样包含在内。
运营者明确不是模型的提供者。权重来自第三方,未经改动即被使用,也没有任何模型被投放市场。
这一归类是运营者的判断,而非任何机关的认定。之所以写在这里,是因为一页谈自身 AI 使用却回避角色问题的说明,恰恰躲开了最关键的那个问题。认为它有误的人,可在第 15 条找到申诉的去处。
9. 风险等级
禁止的做法(第 5 条):无。 不存在潜意识操控、对弱势的利用、社会评分、生物识别、情绪识别,也不推断受保护的特征。
高风险(第 6 条结合附件 III):否。 其中列举的类别没有一项被触及——既非生物识别,也非关键基础设施、教育或职业培训、就业、基本私营或公共服务的获取、执法、移民或司法。一句关于访客数量的话,对任何人都不作决定,对任何人也不产生法律效果。
剩下的是一套生成合成文本的系统,因而受第 50 条透明度义务的约束。这正是第 10 条和第 11 条的主题。
10. 第 50 条逐款说明
该条有多款,针对不同对象。按顺序列出,以便结论可被追溯:
- 第 1 款——直接与人互动的系统必须表明自己是 AI。不适用:这里既无对话也无输入。文本在任何人打开页面之前就已完成并放在那里。
- 第 2 款——生成合成内容的系统,其提供者必须以机器可读的格式标记输出。适用,而此项标记在这里尚未完成。见第 11 条。
- 第 3 款——情绪识别与生物特征归类。不适用。
- 第 4 款第一段——深度伪造。不适用:不生成图像、音频或视频,只有两句文字。
- 第 4 款第二段——为就公共利益事项告知公众而发布的生成文本,必须标明其性质。是否适用存疑——公共利益事项显然指的是公众意见的形成,而不是每一行发布的文字。无论如何都已标明。
- 第 5 款——清楚且可辨识,至迟于首次接触时。已满足:提示就在文本正下方,用页面的语言写成,无需展开,也无需点击任何链接。
第 4 款第二段还值得多说一句。它豁免了经过人工审阅或编辑控制、且由某人承担编辑责任的文本。运营者并不援引这一豁免:这些句子在出现前并没有人阅读——它们是由机器核对的。那是另一回事,把其中一者说成另一者只是图省事。
只有在被强制时才作出的说明,对文本本身什么也没说。这条说明自第一句生成文字起就在每个方框下方。
11. 尚未完成:机器可读的标记
第 50 条第 2 款对提供者的要求,不止于一句可见的说明。输出应以机器可读的格式标记,并可被检测为人工生成,所采用的方案在技术可行的范围内应有效、可互操作、稳健且可靠。
方框下方那句可见的提示并不是这个。它面向读者,而不是面向机器。本站目前没有对生成句子的机器可读标记。
之所以写在这里,是因为一页谈自身 AI 使用却只罗列已尽义务的说明,会失去其意义。想知道自己处境的人,从缺失的东西里学到的比从已有的东西里更多。
难点在于:对于 HTML 页面上两句连贯文字,尚无成熟方法能同时满足上述四项性质。水印是为图像和音频开发的;两句话里几乎无处可藏能经受翻译、引用或复制粘贴的东西。该条例本身也考虑到了这一点:第 50 条第 7 款规定了欧盟层面的实践守则,欧盟委员会已于 2026 年 7 月 20 日发布关于第 50 条的指南。
已经有的:每个方框下方那句可见的提示、模型名称、句子的日期,以及本页。缺什么,就此被指名,而不是被搪塞过去。
12. 人工智能素养(第 4 条)
第 4 条要求提供者和部署者确保其员工以及代表其处理系统运行与使用的其他人员具备足够的人工智能素养。该义务自 2025 年 2 月 2 日起适用,且不论风险等级。
Stats4U 是没有雇员的个体经营者。唯一与该系统打交道的人就是它的建造者;第 5 条中的三项检查源自对模型失误的实测,而不是任何培训课程。因此该义务在很大程度上落空——不是因为它不适用,而是因为没有可以适用的对象。
第 4 条不附带罚款;第 99 条的处罚条款并未提及它。
13. 通用人工智能模型
第 53 条及以下的义务——技术文档、面向下游提供者的信息、著作权合规政策、足够详细的训练内容摘要——由模型的提供者承担,也就是把权重投放市场的一方。这些义务自 2025 年 8 月 2 日起适用。
Stats4U 并非如此。它下载现成的权重,不作改动,也不转交任何模型。
某个模型提供者是否以及如何履行这些义务,运营者无法核实。这是一个已知的限度,而不是相反的断言。
14. 时间表
《人工智能法》于 2024 年 8 月 1 日生效,分阶段适用:
- 自 2025 年 2 月 2 日起:禁止的做法(第 5 条)与人工智能素养(第 4 条),
- 自 2025 年 8 月 2 日起:通用人工智能模型的各项义务、治理架构与处罚,
- 自 2026 年 8 月 2 日起:一般适用,随之而来的还有第 50 条的透明度义务,
- 对于附件 III 项下的高风险系统,日期已由《条例》(EU) 2026/1744(「Digital Omnibus」,2026 年 7 月 24 日刊于官方公报)推迟至 2027 年 12 月 2 日;对于纳入受管制产品的高风险系统,则推迟至 2028 年 8 月 2 日。两者对 Stats4U 均无影响,见第 9 条。
该修订并未推迟第 50 条的透明度义务。就第 2 款的机器可读标记而言,修订法案为 2026 年 8 月 2 日已在市场上的系统规定了 2026 年 12 月 2 日;本案是否属于此列,运营者未作彻底考察。无论如何,第 11 条依然成立。
这些日期是查证而来,不是凭记忆写下的。它们最近一次变动是在 2026 年 7 月,且可能再次变动。以此为据者,宜查阅《欧盟官方公报》。
15. 监督
该条例第 70 条第 1 款所指的国家市场监督机关,在波兰是 Komisja Rozwoju i Bezpieczeństwa Sztucznej Inteligencji(人工智能发展与安全委员会)。它依波兰《人工智能系统法》设立(Dz.U. 2026 第 1003 号,自 2026 年 8 月 11 日起施行)。
认为此处所述使用违反《人工智能法》的人,可以向其提出。也可以写信至 stats4u@lukaswojcik.com;那样更快,且丝毫不影响上述权利。
数据保护方面的投诉由另一机关负责——见隐私政策第 10 条。
16. 其他文件
此外还适用并作补充说明:
这些句子如何产生、过程中哪里出过差错、检查在何处失效,均附测量结果详述于博客。
版本
版本 1.0,截至 10 September 2026。本页是关于实际做法的信息,而非法律意见;它陈述的是运营者本人的判断,未经任何机关或律师审阅。