你没听错,Claude现在可以像人一样用电脑了。
我说的用电脑,不是简单的API操作,而是它真能看屏幕,移动光标,点击按钮,甚至输入文字。
最重要的是,Claude的这些进步不仅仅是在炫技,而是真正让AI向着更实用、更贴近人类的方向发展。
想象一下,你的AI助手不仅可以帮你处理数据,还能直接操作电脑,完成一些复杂的多步骤任务,从此,你可以把更多精力放在真正创新的工作上,而不是被琐碎的操作束缚。
再说回Claude 3.5 Sonnet,这次的升级在代码能力上有巨大提升。
它在SWE-bench上的表现从33.4%提升到了49%,超过了所有公开模型。
尤其是工具使用和多步骤任务处理,比如GitLab,用它来处理DevSecOps任务,效率提升了10%,完全没有额外延迟。
Claude 的这次发布代表着AI开始从单纯的工具向真正的智能体进化。
未来有一天,或许每一台电脑、每一款应用,都会拥有自己的“智能思维”,帮助我们以一种全新的方式去探索世界,完成曾经不可能完成的任务。
这让我不禁想起一句话:“科技的终极使命,是帮助人类实现自我超越。”
Claude 3.5已经迈出了这一步,而接下来,等待我们的将是无限可能的未来。
你,准备好迎接它了吗?
好文章,需要你的鼓励
IDC数据显示,Arm架构服务器出货量预计2025年将增长70%,但仅占全球总出货量的21.1%,远低于Arm公司年底达到50%市场份额的目标。大规模机架配置系统如英伟达DGX GB200 NVL72等AI处理设备推动了Arm服务器需求。2025年第一季度全球服务器市场达到创纪录的952亿美元,同比增长134.1%。IDC将全年预测上调至3660亿美元,增长44.6%。配备GPU的AI服务器预计增长46.7%,占市场价值近半。
保加利亚研究团队通过创新的双语训练方法,成功让AI模型学会了在非英语环境下使用外部工具。他们开发的TUCAN模型在保加利亚语功能调用任务上实现了显著提升,小模型改进幅度达28.75%。更重要的是,团队开源了完整的方法论,为全球多语言AI工具使用能力的发展提供了可复制的解决方案。
AI正在重塑创业公司的构建方式,这是自云计算出现以来最重大的变革。January Ventures联合创始人Jennifer Neundorfer将在TechCrunch All Stage活动中分享AI时代的新规则,涵盖从创意验证、产品开发到团队架构和市场策略的各个方面。作为专注于B2B早期投资的风投合伙人,她将为各阶段创业者提供关键洞察。
清华大学团队开发了首个能同时理解街景、卫星图、轨迹和地理数据的城市AI系统UrbanLLaVA。通过创新的三阶段训练法和多模态融合技术,该系统在十二项城市任务测试中显著超越现有方法,为智慧城市、导航服务、城市规划等领域带来突破性进展,代码已开源。