新全栈」共找到 5133 篇相关文章

算法论文8

AI看图一本正经胡说八道?「一拉一推」让模型看得又准|微软x清华

随着视觉 - 语言模型(VLM)推理能力增强,‘看错’问题凸显。现有方法有局限,微软亚洲研究院与清华提出BiPS,从训练阶段重塑模型‘看图方式’,通过‘一拉一推’机制让模型‘看又准’,实验效果显著。

量子位
新闻资讯7

ChatGPT开测广告!OpenAI终于向“钱”看

OpenAI宣布在美国免费版及Go版测试ChatGPT广告功能,称是为支撑免费用户使用。广告不影响回答内容,会注明“赞助内容”。此外,发布的GPT - 5.3 - Codex广受好评,还将推聊天模型,其融资计划也在升温。

量子位
新闻资讯8

谷歌AI里程碑:一个能「做研究」的系统诞生了,用LLM+树搜索编写专家级软件

谷歌提出能帮科研人员编写「专家级」科研软件的AI系统,融合大语言模型和树搜索,可整合重组知识构建思路。在多领域超人类表现,但局限于可量化任务。

机器之心
算法论文8

ACMMM 2025 | 北大团队提出 InteractMove:3D场景中人与可移动物体交互动作生成框架

北大团队在ACMMM 2025发布InteractMove,首次提出含可移动物体3D场景中基于文本的人 - 物交互生成任务,构建数据集与创框架,在多指标领先,代码与模型已开源。

机器之心
算法论文8

首次实现第一视角视频与人体动作同步生成!框架攻克视角-动作对齐两大技术壁垒

加坡国立大学等联合发布EgoTwin,首次实现第一视角视频与人体动作联合生成,攻克视角 - 动作对齐与因果耦合瓶颈。它基于扩散模型,通过三大创设计解决核心难题,实验性能超基线,为多领域应用提供落地基座。

量子位
新闻资讯8

同一天,百度、OpenAI双双发力高智能AI!先来实测一波原生模态文心5.0

2025年,OpenAI凌晨更GPT - 5系列,百度在世界大会发布文心5.0。它采用原生模态统一建模技术,参数达2.4万亿,评测领先。实测表现佳,其技术在多方面突破,为大模型演进提供路径,助百度重回竞争中心。

机器之心
推荐文章8

Efficiency Law, 物理精确世界模型,及世界模型引擎驱动的具身智能学习范式

2025年秋具身智能赛道火热,特斯拉、英伟达动作不断,数据问题成落地症结。跨维智能贾奎、港中大(深圳)刘桂良探讨突破具身智能学习枷锁的方法,提出Efficiency Law和GS - World世界模型引擎及学习范式。

机器之心
新闻资讯8

银河通用完成25亿元一轮融资,具身智能“头号玩家”现身|甲子光年

2026年初具身智能公司融资热起,银河通用完成25亿元一轮融资,估值超200亿。其自主研发具身智能数据体系与大模型,春晚亮相后产品畅销,在工业和服务端均有成果,具身智能迈向产业化。

甲子光年
算法论文8

多模态推理范式:上海AI Lab作证明“画”出答案比“说”出答案更靠谱

上海人工智能实验室等联合提出DiffThinker模型,利用扩散模型构建视觉推理范式。它在视觉中心任务上表现优异,准确率碾压GPT - 5等模型,还能与MLLM协同推理实现1 + 1 > 2的效果。

深度学习自然语言处理
新闻资讯7

CVPR 2026规:强制披露算力成本,高效率、高透明度论文可获三项认可奖

CVPR2026出台‘计算资源报告表(CRF)’试点计划,要求论文作者报告研究中使用的计算资源,提交报告不影响论文接收决策,展示出色计算效率和透明度的论文可获认可奖项。

机器之心