Multimodal2026-08-12WIRED

新招数能看穿AI模型'内心戏',中国模型或用了美国模型输出训练

在一项突破性进展中,研究人员公布了一种方法,可以窥探Claude、GPT和Gemini等专有AI模型的'推理痕迹'。这项新技术为了解这些复杂系统如何处理信息和做出决策提供了前所未有的窗口,而此前即使是其创造者也对此一无所知。 这项研究最惊人的发现是,一些中国AI模型可能是在美国领先模型生成的输出基础上训练的。这一发现引发了关于知识产权、训练数据来源以及AI发展日益互联——有时也模糊不清——性质的重要问题。 多年来,商业AI模型的内部运作一直是严格保密的。公司将其模型视为黑匣子,只展示输入和输出,而隐藏决策过程。这种新的提取方法改变了这一动态,提供了一种透明度,可能重塑我们评估AI系统的方式。 其影响深远。一方面,检查推理痕迹的能力可以提高问责制,让开发者和监管者更好地理解AI为何做出特定选择。这在医疗、金融和法律等高风险领域尤为重要,因为AI决策会产生现实后果。 另一方面,这项技术引发了关于商业秘密和专有AI架构带来的竞争优势的担忧。如果推理痕迹可以被提取和分析,公司可能需要重新考虑什么算是机密。 此外,关于中国模型基于美国输出训练的发现,凸显了全球AI格局中日益紧张的局势。随着模型变得更加强大,谁训练了谁——以及用什么数据——的问题变得越来越有争议。这一发现可能推动业界对更严格的数据来源标准和更高透明度的呼声。 随着AI的持续发展,能够看到这些数字思维内部的能力,很可能成为研究人员、政策制定者和公众的关键工具。虽然这项技术仍处于早期阶段,但它标志着向揭开驱动现代人工智能的黑匣子之谜迈出了重要一步。

相关资讯