GPT-4o开启太空舱门:AI Space Cortex让航天器具备自主运行能力
加州理工学院、NASA喷气推进实验室等机构合作开发AI太空皮层系统,利用GPT-4o和计算机视觉技术实现太空任务自主操作。该系统能够进行实时场景分析、故障自诊断和重新校准,在机械臂受损情况下仍可恢复90%以上精度。项目已...
加州理工学院、NASA喷气推进实验室等机构合作开发AI太空皮层系统,利用GPT-4o和计算机视觉技术实现太空任务自主操作。该系统能够进行实时场景分析、故障自诊断和重新校准,在机械臂受损情况下仍可恢复90%以上精度。项目已...
英伟达宣布扩展智能AI模型产品线,推出RTX Pro 6000 Blackwell服务器版GPU,为企业提供高性能AI推理能力。公司发布两款新推理模型Nemotron Nano 2和Llama Nemotron Supe...
计算机视觉初创公司Matrice.ai宣布完成种子轮战略扩展融资,云基础设施提供商Voltage Park领投。该公司开发的无代码平台可创建人工智能视觉模型,开发速度比传统方法快40%,成本降低80%。该平台采用数据驱动...
谷歌正在将其基于人工智能的图片转视频技术推广到更多应用程序中。这项技术能够将静态图片转换为动态视频内容,利用先进的AI算法分析图片内容并生成流畅的视频效果。此举标志着谷歌在AI视觉处理领域的进一步布局,预计将为用户提供更...
微软在Windows 11中再次推出AI功能,包括争议性Recall功能的后继者Copilot Vision。该功能通过持续截屏并将数据发送至微软服务器进行分析,旨在成为用户的"真正伴侣"。同时,微软还发布了基于本地语言...
微软推出了Copilot Vision AI新功能,该技术能够扫描和分析用户屏幕上的所有内容。这项AI视觉技术可以实时理解用户正在查看的信息,包括文本、图像和应用程序界面,为用户提供更加智能化的交互体验和个性化建议。此功...
英特尔旗下计算机视觉子公司RealSense宣布完成5000万美元融资并从母公司分拆独立运营。该轮融资由半导体私募股权公司领投,英特尔资本和联发科创新基金参投。RealSense专注于深度感知和追踪技术,其深度相机产品广...
在人工智能与神经科学交叉领域的研究中,科学家正在探索自然发育的生物大脑与人工神经网络之间的异同。如今,实验室培养的生物类器官大脑为这一领域带来了新的复杂性。科学家使用干细胞培养出梨形大脑类器官,这些类器官甚至能够自主生长...
Dell技术团队在构建笔记本电脑物理损伤识别模型时,遭遇了AI幻觉、垃圾图像检测和输出不稳定等问题。项目从单体提示开始,尝试了多模态方法,最终创新性地将智能体框架应用于图像解释任务。通过组合精确的智能体检测、广泛的单体扫...
特斯拉原定6月22日在奥斯汀推出"车内无人"的Robotaxi服务未能如期实现。公司宣布将采用限制性服务模式,配备特斯拉员工作为安全员。与传统做法不同,安全员将坐在副驾驶座而非驾驶座,这一做法此前曾被俄罗斯Yandex公...
Meta本周发布了名为V-JEPA 2的开源生成式AI模型,该模型能够帮助人工智能理解重力和物体永恒性等物理概念。与依赖标记数据或视频模拟现实的传统模型不同,V-JEPA 2强调物理世界的逻辑,包括物体如何移动和相互作用...
本文介绍了 Posha 这款台面机器人,其创始人 Raghav Gupta 希望解决亲自烹饪家常菜所耗费时间的问题。Posha 使用计算机视觉技术,根据用户选择的菜谱和预先添加的食材自动完成烹饪,未来还将引入生成式 AI...
本文讨论了AI如何革新航空航天业,从优化航班运营、提升驾驶舱智能化,到加速飞机设计、精益制造和预测性维护,既提高安全性又降低成本,同时强调需平衡技术、监管与伦理挑战。
Google 在其年度云计算大会上推出了多项 AI 驱动的 Google Maps 新功能,旨在帮助企业和城市改善道路状况、管理交通拥堵并了解当地趋势。这些工具包括利用 AI 识别基础设施、分析地理趋势和管理道路交通等功...
Microsoft 正在测试 Windows 版 Copilot 应用的新更新,允许用户与 AI 助手共享屏幕或应用。Copilot Vision 原本仅限于 Edge 浏览器,现在扩展到 PC 上的所有应用。它可以指导...
Google 推出的 Gemini Live 不仅能进行对话,还能通过摄像头识别物体。这项功能可以帮助用户在日常生活中获取更多信息,如识别艺术品、导航等。它比简单的图像识别更强大,能与用户进行自然对话。目前该功能已开始在...
微软将 Copilot Vision 功能扩展至 Windows 和移动设备,超越网页应用范畴。用户可通过移动设备摄像头实时分析视频,获得植物护理和家居装饰建议。Windows 版本即将推出,支持全系统 AI 辅助,如指...
Google 正式向用户推出 Gemini Live 的新 AI 功能,让用户能够通过手机屏幕或摄像头实时与 AI 进行交互。这项源自 "Project Astra" 的技术,可以实时解读视频内容并回答相关问题。目前该功...
一款名为 "Touch Grass" 的 iOS 应用采用独特方式限制用户使用手机:用户必须走到户外拍摄真实的草地照片,才能解锁受限应用。该应用使用计算机视觉 AI 技术识别真实草地,防止用户使用室内植物作弊。这个既幽默...
Nvidia 发布了 Cosmos-Transfer1 人工智能模型,可生成高度逼真的仿真环境,用于训练机器人和自动驾驶汽车。该模型采用自适应多模态控制系统,能更精细地控制生成环境,显著提高仿真度和实用性。它解决了物理 ...