• 请不要在回答技术问题时复制粘贴 AI 生成的内容
busterian
V2EX  ›  程序员

如果 AI 能够判断“训练它的人定义错了”,它应该服从谁?

  •  
  •   busterian · 6h 21m ago · 558 views

    https://imgur.com/OIJayYd

    anthropic 对 z 国抱有如此敌意的情况下, 是否会把 claude 训练成 z 国用户抱有恶意的 AI, 实在是细思极恐

    5 replies    2026-09-17 11:18:40 +08:00
    sentinelK
        1
    sentinelK  
       6h 17m ago
    决定最终产出倾向和格式的是后训练以及微调。
    所以其实理论上讲,只要是开放权重的模型,有硬件,任何人都可以做到楼主说的效果。

    但是工程学要讲究性价比。作为一个闭源模型,作恶没必要搞这么复杂。
    catazshadow
        2
    catazshadow  
       6h 16m ago via Android   ❤️ 1
    AI 不能判断任何事情,不要拟人化机器
    QingXuJiaZhi
        3
    QingXuJiaZhi  
       6h 15m ago
    恐什么呢?有什么影响吗
    levn
        4
    levn  
       5h 32m ago
    禁止蒸馏有害的国外模型刻不容缓
    jacketma
        5
    jacketma  
       5h 27m ago
    和 fb 、yt 上存在有害 z 国的内容一样啊,应该予以🈲止
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   5319 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 26ms · UTC 08:46 · PVG 16:46 · LAX 01:46 · JFK 04:46
    ♥ Do have faith in what you're doing.