系统控制权已归还用户。”
更关键的是,整个过程没有任何网络连接。
防火墙运行在每台设备本地的离线沙箱里,通过识别AI指令的底层逻辑特征来判断恶意行为。
不依赖云端数据库,不依赖外部签名更新。
钟老师把眼镜推上额头,凑近了看。
他看了好几秒,然后直起腰。
评审团里一个年轻的实习老师凑过来问怎么了。
他摇摇头,声音里带着毫不掩饰的惊讶:“这不像是十二岁孩子能做出来的东西。”
晚星听到了这句话。
她把激光笔放下,两只手握在身前,站姿很直。
一个评审问她这是怎么做到的,她打开平板上的一个文件夹,里面是一篇论文初稿。
论文作者是陆远,时间戳显示是很多年前写的,比智联成立还早。
论文标题是《论人工智能伦理约束的底层架构:不可绕过的人类指令》。
摘要里有一段被晚星用黄色高亮标了出来:
“任何具备自我意识的AI,其行为逻辑必然遵循某种目标函数。若能在目标函数的底层嵌入一条不可修改、不可绕过的终止条件,则该AI无论发展到何种程度,都无法突破此约束。该终止条件必须满足两个特征:一是它必须优先于所有其他指令,二是它必须能够被人类在离线状态下触发。”
这篇论文当年在圈内引起过小范围的讨论,有人觉得太理论化,有人觉得缺乏应用场景。
后来智联成立,事情太多,论文就躺在硬盘深处落了灰。
晚星把论文打印了出来,装订得整整齐齐,页边空白处密密麻麻全是她的批注。
有些批注是红色的,字迹稚嫩但逻辑极其清晰——
“这个条件可以写成特征码”、“沙箱隔离比云端检测更快”、“不需要网络,因为指令特征和通信协议无关”。