1.个人信息:一旦输入,就离开了你的掌控
输入对话式AI的内容,会被发送到服务提供方的服务器上处理。根据服务和设置的不同,对话记录可能被保存,可能为改进质量而由人工审阅,也可能被用于训练。怎么处理因服务而异,政策也会变化。所以,以“这条信息被别人看到也没关系吗”为标准来决定要不要输入,比较稳妥。
尤其是身份证号码、护照和驾驶证号码、银行账号和卡号、密码和验证码、健康信息、准确的住址和联系方式,都不要输入。不只是你自己的信息,家人、客户、同事的信息也一样。未经同意输入他人的个人信息,可能侵犯对方的权利;如果是工作上的事,还可能引发法律问题。
- 不要输入:身份证号码、银行账号和卡号、密码、验证码、健康信息、准确的住址和联系方式
- 替换后再输入:姓名换成A、B,公司换成“一家制造企业”,数字只保留必要的部分
- 公司资料:先确认公司允许使用的服务和相关规定
- 检查设置:查看服务的设置和政策,看能否关闭对话记录保存和用于训练
- 错误: 帮我给张三(010-1234-5678,○○市○○区)客户发来的投诉邮件写一封回信。正确: 客户A投诉“发货晚了一个星期”。请写一封礼貌的回信,内容是致歉,并承诺在下周二之前重新寄出。写回信用不到姓名和电话号码。只保留工作必需的信息,其余的删掉或替换掉。
2.版权:能做出来,不等于可以用
AI利用从大量文字和图片中学到的模式生成新的成果。这时会产生两个问题:一是AI生成的成果是否与他人的作品过于相似;二是谁对AI生成的成果享有什么权利。这两个问题,各国的法律和判断都不一样,至今仍有争论和诉讼在进行。
所以,可以践行的原则最好定得保守一些。避免要求它照抄般地再现某部作品的句子或某个角色,避免要求它原样输出歌词或书中的大段正文。商业使用或公开发布AI的成果时,要确认所用服务的条款是否允许这种用途。
还要知道,AI生成部分较多的成果,可能得不到作为人类创作作品的保护。许多国家认为版权保护的是人的创造性表达。如果是重要的创作,就把自己亲自策划和修改的部分记录下来,必要时咨询专业人士。
3.偏见:数据的偏向会变成回答的偏向
就像第2讲讲的那样,基于学习的AI从数据中学习。如果数据里含有社会的刻板印象或对某些群体的偏向,AI也会学到。比如让它描述职业时,它可能把性别或年龄只往一个方向写,或者对某些地区或语言给出不那么准确的回答。
偏见不容易被察觉,所以更要小心。如果把AI用在招聘、贷款、评价等影响他人的决定上,就要另外检查结果是否对某些群体不利。在日常生活中,“AI是这么说的”也不能作为公平的依据。
- 意识到结果中存在反映刻板印象的偏见。
- 在提示词中加上条件:“性别、年龄、职级要均衡搭配,不要依赖刻板印象。”
- 用同样的标准把重新得到的结果再检查一遍。
- 最终材料要结合实际团队构成和当事人的意见,由人来定稿。
4.责任:谁发布,谁负责
AI是工具,决定使用结果的是人。AI写的报告里有错误数字,由交报告的人负责。AI生成的文字如果损害了某人的名誉或侵犯了版权,发布这些文字的人就可能要承担责任。“是AI这么写的”不能当作借口。
所以,以自己名义发布的成果要确认三点:事实和数字是否正确(第7讲);是否侵犯他人的权利;是否会伤害读者或引起误解。是否说明用了AI,也要根据情况来判断。如果读者需要知道这一点才能作出判断,说明就是维护信任的做法。
还要警惕AI被滥用。模仿真人声音或面孔的假视频、假语音,以及以假乱真的诈骗短信,有了AI之后变得更容易制作。突然要钱或要个人信息的联系,即使声音或文风很熟悉,也一定要通过其他渠道确认。
5.使用AI前后的检查表
检查表看起来很长,但养成习惯后几秒钟就能完成。一开始只用在重要的事情上,熟悉以后再扩展到日常。
| 时机 | 要确认的事 |
|---|---|
| 输入前 | 有没有包含个人信息、密码、机密?是否只保留了必要的信息? |
| 输入前 | 公司或学校是否允许使用这项服务、用于这个用途? |
| 得到结果后 | 事实、数字、出处是否已用一手资料核对过? |
| 得到结果后 | 有没有针对某些群体的刻板印象或偏向? |
| 发布前 | 是否与他人的作品过于相似?服务条款是否允许这种用途? |
| 发布前 | 是否属于需要说明使用了AI的情况?是否已准备好承担最终责任? |
6.把检查表用到实际情况中
检查表要亲自用一次才能真正掌握。下面以日常中常见的一个情况为例,按输入前、得到结果后、发布前的顺序走一遍。情况是为了讲解而设定的。
- 输入前①:学生姓名和成绩是个人信息。把姓名换成学生A~E,只保留短信需要的信息(成绩变化、做得好的地方、需要加强的地方)。
- 输入前②:确认工作单位是否允许为这种用途使用AI,是否另有指定的服务。
- 得到结果后:对照原表逐行核对,确认成绩和内容没有在学生之间张冠李戴。也要看有没有贬低某个学生、或依赖性别和家庭背景的表述。
- 发布前:把A~E换回真实姓名的工作,由人在AI之外完成。发送者是老师本人,所以最后再读一遍再发送。
📌 要点总结
- 输入的信息会被发送到服务器——只输入被别人看到也没关系的信息
- 姓名、联系方式等要删除或换成A、B;公司资料先确认允许的规定
- 版权问题各国判断不同,仍在讨论中——避免模仿和大量复制,并确认服务条款
- 数据的偏向会变成回答的偏见——越是影响他人的决定,越要另外检查
- 对结果负责的,是发布它的人
🤖 可以这样问 AI
复制后把 [ ] 部分换成你的情况。不要直接相信回答,请与正文对照核实。
想练习删除个人信息的标准时
下面是用假名字和假号码编写的练习文本。请找出其中所有能识别个人身份的信息(姓名、联系方式、住址、各类号码、与日期结合的特殊信息等),列成清单,并生成一份把它们分别替换成[姓名1]、[联系方式1]这类标记的文本。也请告诉我,自己处理真实资料时容易漏掉哪些项目。 [用虚构信息编写的练习文本]
想检查自己做的成果有没有偏见时
请找出下面这段文字中有没有关于性别、年龄、地区、职业、残障等的刻板印象或偏向一边的表述。针对每一处,说明为什么可能有问题,并提出更中立的表述。 [文字]
- 韩国《个人信息保护法》的一般原则(最少收集、限制目的外使用)
- 韩国著作权委员会等公共机构关于生成式AI版权指南的一般性内容
达成全部学习目标后,请点击完成。
此浏览器无法保存记录,仅在当前页面显示。