「深度补全」共找到 2634 篇相关文章
首篇具身智能机器人「安全」综述:LLM如何跨越物理鸿沟?
最新综述首次系统探讨LLM控制机器人的安全威胁、防御机制与未来挑战,指出LLM的具身鸿沟导致其在物理空间可能执行危险动作,而现有防御体系存在逻辑与物理脱节等问题。
AI鉴别攻略全废!别数破折号了,97%的人根本分不清
当AI学会故意写错别字、流露人味,以往靠破折号、排比句等的鉴AI攻略失效。人类直觉也不可靠,文章建议从上下文、风格连贯性鉴别,还指出AI话术平庸反映人类表达荒芜。
以AI革新研发:从数字协同到智能工艺的全链路升级
文章介绍“数字化大研发体系”,Geega捷做设计研发协同平台从三维度重塑研发管理,解决五大问题;Geega工艺专家数智引擎系统让工艺环节智能化跃升,该体系能带来立体价值,提升企业效率。
“交互式Scaling”:增加Agent与环境交互的深度和频率来提升性能
在AI发展中,商业研究Agent是“黑箱”,开源研究Agent性能有差距。MiroMind团队推出MiroThinker v1.0,提出“交互扩展”提升性能,在多基准测试表现出色,也指出了当前版本的局限。
Gemini 3.0 登场后,哈萨比斯要「改造」Google 全系产品
Gemini 3.0登场引发热议,被视为Google近年最稳健升级。Google DeepMind CEO哈萨比斯谈其研发过程、团队推进能力等。新模型各方面提升显著,还将强化个性化、记忆等能力,Antigravity开发平台也备受关注。
谷歌Nano Banana Pro上线,深度结合Gemini 3,这下生成世界了
谷歌最新图像生成模型Nano Banana Pro(Gemini 3 Pro Image)上线,结合Gemini 3 Pro强大推理与知识,在控制力、文字渲染和世界知识方面升级,能生成高分辨率、一致性强图像,还支持创意操控、多语言文本生成等,多产品将上线。
深度长文解读 “世界模型” :在虚构与真实交接之处凝视未来
本文深入解读“世界模型”,虽无明确定义,但从目的出发分为表征和生成两类。前者含生物大脑、视觉和语言中心预测;后者有基于规则模拟和数据驱动生成。还探讨LLM是否为世界模型,指出各类模型相辅相成。
DeepAgent:能够自主找工具的深度思考智能体,工具&任务随心配
现有智能体框架自主性差、工具使用受限。中国人民大学等机构研究者提出DeepAgent,能自主思考、发现工具并执行动作。它在多基准测试中表现出色,为构建更强真实世界智能体迈进重要一步。
超越纯视觉模型!不改VLM标准架构,实现像素级深度预测
Meta开源DepthLM,首证视觉语言模型不改架构,也能媲美纯视觉模型的3D理解能力。它通过视觉提示等策略,解锁VLM多任务处理潜力,为自动驾驶等领域带来前景。
教全世界与AI对话的男人,正式加入DeepMind!提示工程封神
全球最牛提示工程师Riley Goodside入职谷歌DeepMind,他曾凭和ChatGPT聊天年入百万。他认为ChatGPT发布是提示工程里程碑,提示工程可分上下文工程和提示词编程。