得益于AI生成代码,开发团队或许能以惊人的速度交付软件和应用程序。然而,代码中可能潜藏着一些不易察觉的错误,足以让一次更新彻底崩溃。
在本期InformationWeek播客中,Togal.AI首席技术官奥列克桑德·帕拉斯卡(Oleksandr Paraska)与LaunchDarkly首席技术官卡梅隆·埃特扎迪(Cameron Etezadi)围绕一个棘手问题展开讨论:如何发现那些"看起来差不多"、实则暗藏问题的错误代码?
两位嘉宾都指出,AI生成代码正在以前所未有的速度推动产品落地,但筛查出那些有问题的脚本也随之成为新的挑战——尤其是在表面上一切正常的情况下。更棘手的是,AI往往会"自信地"认为自己的代码没有问题,无需修复。
两位首席技术官分享了他们用于识别AI代码"差一点就对"的方法,以及工程师的技能如何随着AI编程工具的引入而不断演变。
本期节目还照例带来了"问题创意桌面推演"环节。帕拉斯卡和埃特扎迪在节目中应对一群"捣蛋鬼"的轮番挑战——这些虚构角色各自提出了一些异想天开、不切实际的处理AI生成代码错误的方案,颇具娱乐性。
Q&A
Q1:AI生成代码为什么容易出现难以发现的错误?
A:AI生成的代码往往在表面上看起来运行正常,逻辑也"差不多对",这使得错误很难被直接察觉。加之AI本身可能对自己生成的代码"过度自信",认为无需修复,开发者容易放松警惕。这类隐性错误一旦进入生产环境,可能在某次更新时才突然暴露,造成系统崩溃或功能异常。
Q2:Togal.AI和LaunchDarkly的CTO用什么方法来检测AI代码中的问题?
A:两位CTO在播客中分享了他们各自团队的实践经验,核心在于识别AI代码"接近正确但仍有偏差"的情况。他们强调需要建立专门针对AI生成代码的审查机制,而不能沿用传统的代码审查流程,同时也提到工程师的技能正在随着AI工具的普及而发生结构性转变,审查与验证能力变得尤为重要。
Q3:AI编程工具的普及对工程师的技能要求带来了哪些变化?
A:随着AI编程工具的广泛应用,工程师不再只需关注"如何写代码",还需具备更强的代码审查、逻辑验证和错误识别能力。AI负责提速,人类负责把关,工程师的角色正在从"编写者"向"审核者"转变,理解代码意图和评估代码质量的能力变得越来越关键。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。