推理与计算」共找到 8015 篇相关文章

推荐文章7

人手数据,如何重塑机器人基础模型?专访 LaST-HD 一作刘家铭

本文是对 LaST-HD 一作刘家铭的专访。围绕数据路线之争,刘家铭分享交付背后的技术问题,也谈了对具身领域模型数据发展方向的判断。他认为 Human Data 真机数据非替代关系,VLA 和世界模型可共存。

AI科技评论
新闻资讯8

剑指“美国版 DeepSeek!”Ai2 科学家 Nathan Lambert 最新访谈:剖析 RLVR、激辩智能体后训练

艾伦人工智能研究所科学家 Nathan Lambert 在访谈中剖析 RLVR、激辩智能体后训练。他所在团队用 Olmo 和 Tulu 模型揭开后训练魔法,带火 RLVR 概念。他还谈到开源 AI 未来,想打造“美国版 DeepSeek”。

AI科技大本营
新闻资讯8

“你们尽管做空 OpenAI!”奥特曼霸气喊话,纳德拉亲述微软百亿投资内幕 | 巨头对话

外网播客中,微软CEO纳德拉OpenAI CEO奥特曼对话,谈及微软OpenAI新合作协议,涵盖股权、收入分成等。还讨论算力投入、AGI规则、上市传闻等话题。二人对合作成果满意,对未来发展充满信心。

AI科技大本营
产品应用7

亿级日活App的“算力生死劫”:推理成本倒挂,他们靠跨云架构砍掉75% GPU集群

一家AI穿搭+购物推荐的出海应用DAU破亿,但算力和传输成本高,ARPU远低于成本。该企业转向Akamai推理云,换用RTX PRO 6000,缩减服务器集群,降低成本,采用跨云架构过渡,实现零阵痛平替。

量子位
算法论文8

不用递归自动微分,也能稳定计算高阶 PDE 导数? Mollifier Layers 如何改造 PDE 反问题学习

本文介绍《Mollifier Layers: Enabling Efficient High-Order Derivatives in Inverse PDE Learning》,指出传统PINN递归自动微分计算高阶PDE导数有瓶颈,Mollifier Layers用解析卷积替代,实验显示其在精度、效率上有优势,也有核选择等局限。

力学与人工智能
算法论文8

挑战 1 比特!ETH Zürich 秦浩桐:如何把大模型「塞进」小设备?| IJCAI 2026

IJCAI 2026大会上,秦浩桐给出创新解法,挑战无需重训的“后训练量化”极限,将庞大的LLM强行压缩至极端的1比特2比特。其团队的BiLLMSqueezeLLM打破了后训练量化魔咒,还指出极低比特量化的三大挑战。

AI科技评论
产品应用8

深夜突袭!谷歌Gemini 2.5 Pro更新蝉联榜一:推理超越o3,编程超越opus4

深夜谷歌对Gemini 2.5 Pro模型重大更新,在编码、推理等测试中超越o3,几周内成稳定版。其价格优势大,还增加思考预算,输出风格和结构改进,用户实测反馈佳,但发布不久被越狱攻击。

机器之心
推荐文章8

面向多工具任务调度的两种路径:MCP vs Agent + Function call

本文围绕大语言模型智能应用中的工具数据接入问题,介绍了基于 Agent + Function Call 的动态调度机制基于 MCP 的标准化接入框架,分析了不同场景下的适用性,还探讨了二者未来的协同融合方向。

阿里云开发者
新闻资讯7

独家|RoboScience 机器科学完成10亿元融资,资金将用于强化 VLOA 大模型本体

AI科技评论独家消息,RoboScience机器科学近日完成10亿元A轮融资,将深化VLOA大模型技术,推进自研机器人本体工程化量产。其VLOA大模型有创新性架构,能实现通用泛化,还将发布自研机器人本体。

AI科技评论
产品应用8

实测!DeepSeek V4-pro是第一个接近Claude开源模型,前Meta研究员震惊

DAIR.AI创始人、前Meta AI研究员Elvis用DeepSeek - V4 - Pro在Pi框架搭LLM知识库,该模型开箱即用,完成知识密集型多步研究任务表现出色,在开源模型里Agent编程和推理能力强,架构设计让推理快且成本低。

AI寒武纪