「物理场景测试」共找到 3838 篇相关文章
GPT-5正以o3的三倍速度打宝可梦,现已抵达冠军之路,直播进行中
GPT - 5直播独立运行宝可梦红版,速度比o3快近三倍,6105步抵达冠军之路,而o3需16882步。原因是其幻觉少、空间推理和规划能力强。直播已进行9小时,超2000人关注,OpenAI总裁点赞。
40年首次突破!清华大学发布全新最短路径算法,打破理论瓶颈:数据中心有望节省大量计算资源
清华大学Ran Duan、Longhui Yin团队发表论文,提出确定性新算法,在稀疏图上表现超经典Dijkstra算法。新算法时间复杂度为`O(m log²/³ n)`,不维护全局有序顶点队列,应用前景广,可节省计算资源。
上海 AI Lab 庞江淼:开放平台是具身智能“ChatGPT 时刻”的前提|具身先锋十人谈
上海AI Lab庞江淼认为开放平台是具身智能“ChatGPT时刻”的前提。他早期专注CV,后转型切入底层控制。他指出具身智能Scaling Law非简单线性,还探讨了大小脑融合、VLA技术等,团队发布的Intern - Robotics目标是建开放基础设施。
SimpAgent (ICCV2025 Highlight):上下⽂简化重塑GUI智能体,更少计算,更强性能
在多模态大模型加持下,纯视觉GUI智能体成通用操作智能体重要方向,但面临元素与历史上下文问题。哈工深和华为提出SimpAgent,从上下文简化建模入手,实现更快更强性能,工作被ICCV 2025录用。
JFM | 西北工业大学杨忠鑫、张伟伟等:数据驱动的特定且可泛化的湍流封闭知识发现
本文基于高精度数据结合符号回归等方法重建混合长理论,提出解决泛化性问题的策略。通过槽道等基本流动获普适公式,用于封闭求解RANS方程,在工程附着流中提升精度,为飞行器摩阻预测提供新工具。
BLIP3-o统一图像生成与理解,多模态融合趋势显现
BLIP3 - o致力于统一图像理解和生成,提升生成质量与效率。它融合自回归和扩散模型,采用CLIP + Flow Matching架构等。经训练,在图像理解和生成任务表现佳,指令微调效果显著。
0.016%参数撬动18%性能:关键表征微调破解LLM推理瓶颈
大语言模型在推理任务依赖思维链技术,传统PEFT方法需修改大量参数,新兴ReFT虽只需调整少量参数,但存在不足。本文提出CRFT,仅用0.016%参数量就提升性能,为轻量化推理增强开辟新路径。
烧钱换能力,老员工经验作废!一线Agent厂商、用户经验亲述:抛弃技术驱动,巨额投入如何不打水漂?
InfoQ 对话来也科技 CEO 汪冠春、英科医疗 CTO 陈坤,从产品提供商和应用方角度,讲述 Agent 产品理念与应用策略。探讨定位、转型、挑战等,还提及成本、未来设想与出海经验。
宇树王兴兴,A股上市辅导公告了
宇树科技创业九年正式冲刺A股上市,其创始人王兴兴持股情况曝光。公司估值超百亿,产品涵盖多类型机器人,应用潜力大。当下具身智能领域投资火热,行业正迈向产业场景落地。
迟到3个月的美图Agent,RoboNeo居然有一些惊喜?
美图公司推出专注影像与设计的AI智能体RoboNeo,虽来得有点迟,但实战测评中它和星流Agent各有优劣。星流是光影与排版“偏科生”,RoboNeo是细节与执行“实干派”,适配不同需求。