「具身智能模型」共找到 9656 篇相关文章
扩散模型自引导新范式:直接交换token就能变强! | CVPR‘26 Oral
上海交大和vivo研究者提出自交换引导(SSG),不依赖文本条件、不加噪声、不改模型,只交换token特征。在多数据集实验中,SSG表现超现有方法。不过,其缺理论支撑、计算开销大。
用AI把一段视频变成可视化网页,Google的新模型又卷飞了。
Google将Gemini 2.5 Pro更新为05 - 06版,此版代码能力在WebDev Arena盲测竞技场登顶,还提升视频理解能力,可将视频变成可视化网页,虽产品有不足,但模型进步值得肯定。
单卡即可微调大模型!内存占用仅1/8,性能依然拉满 | ICML 2025
基础大模型应用于下游任务时微调成本高,低秩适应(LoRA)方法虽降低成本,但性能不及全量微调。华中科技大学和香港中文大学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。
AI地理学家诞生:麻省理工、斯坦福用多智能体框架重塑地理空间建模,刷新SOTA
麻省理工、慕尼黑工大及斯坦福AI实验室发布GeoEvolve框架,深度融合地理知识与进化算法,实现复杂地理空间模型自动发现与优化。经实验验证,其性能超越以往基准,有望在多领域发挥作用。
10倍加速化学推理大模型!Haven团队在隐空间思考分子式,碾压显示CoT
Haven团队提出LatentChem,把化学推理从‘文本表面’挪到‘模型内部’,先在隐空间思考,再在语言空间回答。它拆分‘推理’与‘表达’,性能优异,为AI Scientist奠定基础。
ICCV25 Highlight|格灵深瞳RICE模型狂刷榜单,让AI「看懂」图片的每个细节
格灵深瞳公司灵感团队自研的视觉模型基座RICE(MVT v1.5)刷榜多项视觉任务,在ICCV25获Highlight荣誉。它延续MVT系列理念,提升图片内部视觉特征差异性,在多任务验证中表现优异。
Pinecone 推出 Nexus 引擎:为 AI 智能体整合业务上下文并生成结构化数据
Pinecone Nexus 全面上线,是面向 AI 智能体的“知识引擎”,能将企业数据转为结构化数据层,复用数据提准确性、降成本。早期采用者在金融、法律领域看到显著性能提升,词元消耗大幅降低。
独家丨雷军马云罕见握手,千寻智能30天完成30亿元融资
2026年4月7日,千寻智能完成10亿元融资,30天两轮累计30亿。雷军、马云旗下资本领投。其技术路线与国外Generalist AI吻合,数据采集有优势,还与京东、宁德时代合作,获资本青睐。
Zed 为什么不用自己造 Agent?OpenAI 架构师给出答案:Codex 重划 IDE × Coding Agent 的分工边界
文章围绕Coding Agent展开,介绍其构成、构建Harness的挑战,还阐述Codex作为集成系统优势、使用方式及未来发展。强调将模型与Harness共同开发,能更好理解模型行为,Codex可助力构建差异化产品。
AI 教父辛顿最新对话:超级智能诞生之后,我们唯一的生路是当“婴儿”
在大模型热潮下,“AI 教父”杰弗里·辛顿接受采访,剖析神经网络奥秘,分享对 AI 未来构想与忧虑,包括五年内超级智能诞生可能、人机共存方案,还谈及监管、就业影响等问题。