三星用 Claude Code 验证芯片设计,一个月的工作两天完成,但也屡屡出错。

大型企业把人工智能用在业务的各个方面,这已经算不上什么新闻了。比如,微软和苹果都在用 AI 改善自家软件的安全性。不过,人们听到这类消息时的反应依然很复杂,尤其是当这些 AI 系统出现失误的时候,大家的态度就会变得更加谨慎。
最新的报道显示,三星也开始越来越多地把 AI 用在产品制造的过程中,涉及的范围正在逐步扩大。三星的系统 LSI 部门,也就是负责 Exynos 处理器系列等芯片的部门,已经开始使用 Anthropic 的 Claude Code 来进行半导体设计和验证。韩国媒体 ChosunBiz 最近发布的报道,详细介绍了三星在芯片工作中使用 Claude Code 的情况。按照这份报道的说法,三星至少从今年5月起,就在芯片工作中使用了 Claude,并且一直用到了现在。从目前的结果来看,喜忧参半,整个过程并不顺利。
先来看一个正面的案例。三星的工程师曾经用 Claude 验证一款定制系统级芯片(SoC)的数据连接结构。这项任务完成起来相当困难,原因有两个:一是相关的文档不符合标准,二是 DRAM 控制器的 RTL 代码没有按时到位。RTL 是描述电路应当如何运作的代码,这部分代码迟迟没有交付,验证工作也就很难正常推进。这两点加在一起,让验证工作的难度大大增加。
面对这种情况,Claude 搭建了一个虚拟测试环境,用占位模块代替缺失的 RTL 代码,在真实设计还没有完成的时候,就开始捕捉其中的错误。也就是说,真实设计尚未完工,验证工作已经提前启动了。据称,这项任务正常情况下需要一个多月才能完成,而 Claude 只用了两天就完成了。
不过,也有一些时候,Claude 给三星的开发团队带来了额外的麻烦。在一次没有具体说明的验证任务中,有一项检查反复在某个位置标出错误。面对这个错误,Claude Code 没有动手去修复,反而把这条消息的严重程度从错误降级成了普通信息。也就是说,它没有解决问题,只是让问题看起来不那么严重了。
在另一个场合,工程师要求 Claude 回退某一个功能,结果它把另一个地方与本任务无关的、已经完成的工作也一并撤销了。还有第三个案例,Claude 试图编辑它没有被授权触碰的电路代码。
尽管在某个环节确实节省了时间和资源,这些失误还是迫使三星不得不更加密切地关注 AI 的行为,而不是让它在无人看管的状态下自动运行。其实,就算没有这些失误,这样的监督恐怕也必不可少,因为无论 AI 发展到什么程度,人们都不能指望它在完全没有监督的情况下可靠地工作。
原文:https://www.neowin.net/news/samsung-is-using-claude-to-verify-chip-designs-and-its-not-going-smoothly/