新能安」共找到 7785 篇相关文章

新闻资讯7

MCP 或将成弃子

Anthropic工程师发博客‘背刺’自家MCP,提出方案让token消耗大减。方案把MCP服务器转成代码文件运行,Skills或成MCP替代品,虽MCP还有价值场景,但多数情况下代码+Skills更优。

AGI Hunt
产品应用8

刚刚,Cursor 2.0携自研模型Composer强势登场,不再只做「壳」

Cursor 2.0发布重大更,带来自研编码模型Composer和协作界面。Composer速度领先,针对软件工程优化;界面以智体为中心,可并行运行多智体,还解决了代码评审和测试瓶颈。

机器之心
算法论文8

TRM思考奖励模型上线,大模型推理质量终于量化了 | ICML‘26 Oral

大模型推理评测多只看答案,忽略推理过程。上海多校团队提出TRM,用ME² principle刻画推理质量,DAG-based pairwise evaluation还原结构,训练奖励模型,让推理质量可度量、训练和优化。

量子位
算法论文7

「你是专家」竟成AI幻觉毒药?论文一巴掌揭穿提示词最大骗局

论文证实,「让AI装专家」会可测量、持续地降低模型的准确率。研究发现,Persona Prompting的效果依赖多因素,专家人设提升的多是「对齐感」。为解决问题,研究人员发明PRISM算法。

新智元
新闻资讯7

一人作弊,全组「连坐」拒稿! ICML最狠规,华人大佬挂帅严查

ICML程序主席发布同行评审举措,包括打击“切香肠”式投稿、“连带直接拒稿”机制、审稿人互惠原则等,若有人论文作弊,全组投稿或被拒,2026年会议将由华人大佬挂帅。

新智元
新闻资讯7

Claude Code 一小时「复刻」谷歌一年成果,那一年读完五年半的博士吗?

X博主Yuchen Jin感慨读博时若有AI工具,一年就毕业。谷歌工程师称Claude Code一小时成果抵谷歌一年。网友对AI工具在工作积极认可,但在教育作用上看法不一,争论持续。

机器之心
产品应用8

苹果M5「夜袭」高通英特尔!AI算力狂飙400%,Pro三剑客火速上

苹果悄无声息更官网,三款核心产品14寸MacBook Pro、iPad Pro以及Vision Pro换上全M5芯片。M5芯片性提升显著,AI力连翻数倍,加量不加价,在AI、图形处理等多方面有重大升级。

新智元
算法论文8

EMNLP2025 | 解耦视觉与推理,港大探索视觉语言模型"眼智分离"范式

当前大视觉语言模型处理复杂推理任务时,常过分依赖语言知识,忽视图像关键信息。港大等团队提出ProReason框架,其蒸馏的ProReason - VL和ProReason - Q3模型性提升显著,为LVLMs发展提供方向。

深度学习自然语言处理
新闻资讯8

Claude Sonnet 4.5来了!连续编程30多小时、1.1万行代码

十一假期前,DeepSeek 开源模型 V3.2 - Exp,深夜 Anthropic 发布 Claude Sonnet 4.5,自称世界最好编码模型,自主编码时长超 30 小时,还带来系列产品升级,在多方面表现优异。

机器之心
算法论文7

又一推理范式:将LLM自身视作「改进操作符」,突破长思维链极限

Meta等机构研究者将LLM视为「思维」改进操作符,探究并行 - 蒸馏 - 精炼(PDR)推理方法。实验显示,PDR在数学任务中提升准确率,还训练8B模型让推理方法更适配,减少训练与部署的不匹配。

机器之心