「o3 - Pro」共找到 2509 篇相关文章
LeCun怒揭机器人最大骗局,坦白Llama与我无瓜!
Meta首席AI科学家LeCun在MIT演讲称,机器人行业离通用智能还远,家用机器人需AI突破,核心是打造‘世界模型’架构。此观点引特斯拉、Figure高管回怼。他还表示LLM有本质瓶颈,世界模型将成未来AI主流。
让LLM扔块石头,它居然造了个投石机
港中大研究团队带来《Agentic Design of Compositional Machines》,推出BesiegeField平台,支持并行实验和大模型‘自我进化’。它将机械设计转为语言生成任务,通过闭环训练提升模型能力,多个模型测试表现良好。
蚂蚁dInfer框架,让扩散大语言模型推理速度再飙10倍,相同模型性能下超越自回归模型
蚂蚁开源dInfer框架,联合名校发论文阐述实现细节。它解决扩散模型推理难题,提出创新算法和系统优化策略,实验显示其推理速度远超Fast - dLLM和自回归模型标杆vLLM,代码已开源。
为防AI刷题,Nature等顶刊最新封面被做成数据集,考验模型科学推理能力|上海交通大学
上海交通大学王德泉教授课题组提出MAC基准,用顶级期刊最新封面构建测试集,评测多模态大模型能力。研究设计两种含“语义陷阱”的测试任务,发现顶尖模型有局限,还提出DAD方法提升表现,采用双重动态机制。
国产大模型持续开源的一周:DeepSeek、Qwen、字节、书生~
国产开源大模型持续发力,本周DeepSeek V3.1、字节Seed-OSS-36B等接连发布。此外,马斯克xAI正式开源Grok 2.5,英伟达也开源了Nemotron-Nano-9B-v2。PaperAgent专题进行了梳理盘点。
6.6K Star 打破次元壁!MCP-Use开源爆火:6行代码让LLM操控万物!
在AI Agent开发热潮中,MCP-Use作为开源Python库爆火。它用6行代码让LLM操控万物,支持多模型、多服务器,提供安全机制,适配网页浏览、3D建模等多种场景,降低AI Agent开发门槛。
追剧不断网,可能背后有个AI在加班,故障诊断准度破91.79%
中兴通讯和中国移动团队针对电信网络故障诊断难题,提出 TN - RCA530 基准和 Auto - RCA 框架。测试多个大模型,初始准确率低,经框架优化后,Gemini - 2.5 - Pro 准确率从 58.99% 升至 91.79%,超人工水平。
40年首次突破!清华大学发布全新最短路径算法,打破理论瓶颈:数据中心有望节省大量计算资源
清华大学Ran Duan、Longhui Yin团队发表论文,提出确定性新算法,在稀疏图上表现超经典Dijkstra算法。新算法时间复杂度为`O(m log²/³ n)`,不维护全局有序顶点队列,应用前景广,可节省计算资源。
Agent KB:经验池让Agents互相学习!GAIA新开源SOTA,Pass@1性能最高提升6.66
来自多家机构团队发布 Agent KB 框架,构建经验池实现 AI Agent 经验共享。在 GAIA 基准测试中表现出色,提升多模型 Pass@1 性能,还在软件工程领域展现价值。其设计精妙,经消融、检索策略等实验验证有效。
老黄投了个120亿美元最贵种子轮!但小钱:H20中国开卖,市值一夜暴涨1600亿美元
OpenAI前CTO Mira创立的Thinking Machines Lab获约20亿美元融资,估值达120亿美元,英伟达领投。同时,英伟达老黄宣布H20恢复中国销售,推出RTX Pro新显卡,市值一夜涨1600亿美元。