超节点技术」共找到 4683 篇相关文章

开源动态8

AI编程里程碑!谷歌AI自己写代码惊呆工程师,GPU内核算法反人类21%

谷歌AlphaEvolve的开源实现OpenEvolve自学写代码,在苹果芯片上进化出比人类快21%的GPU核函数。它自主发现多项优化策略,经多维度测试,性能显著提升,开启「AI为AI编程」新时代。

新智元
算法论文8

DeepResearch的概念、核心挑战与进化路径

华为、利物浦大学等研究者撰写综述文章《DEEP RESEARCH AGENTS》,梳理了DeepResearch进展。它由大语言模型驱动,越RAG等现有技术,介绍其核心技术组件,指出面临的挑战并指明未来发展方向。

AI工程化
8

一天 15k 星,代码生成碾压 Claude,连 Cursor 都慌了?谷歌 Gemini CLI 杀疯了

谷歌发布 Gemini CLI,是其 AI 助手终端版,有慷慨免费使用配额。它开源且功能多,支持多平台。接入 Gemini 2.5 Pro 通用模型,开发者反馈其代码生成和修复能力强,谷歌在代码能力上提升明显。

InfoQ
算法论文8

北大腾讯突破奖励模型瓶颈!让AI理解人类偏好,泛化能力比肩GPT-4.1

北京大学知识计算实验室联合腾讯等机构提出RewardAnything,突破奖励模型瓶颈。它让奖励模型理解自然语言评判原则,降低成本,泛化能力比肩GPT - 4.1,还能用于定制AI行为模式。

量子位
新闻资讯7

疯狂……韩国开发出强大的核灾难处理人形机器人。丑,但实用

韩国原子能研究院正开发用于核灾难响应和废料处理的人形机器人,目标是能举200公斤重物。与其他机器人相比,其举重能力优势明显。不过在真实核灾难现场应用还需长期测试。

AGI Hunt
推荐文章8

从RLHF、PPO到GRPO再训练推理模型,这是你需要的强化学习入门指南

强化学习是当今LLM重要技术,Unsloth团队发布教程,从吃豆人谈起,介绍RLHF、PPO到GRPO,分享用GRPO训练推理模型技巧,涵盖相关概念、训练方法及奖励函数设计等内容。

机器之心
开源动态8

Kimi新模型拿下代码开源SOTA,仅仅72B,发布即开源

深夜,Kimi发布新开源代码模型Kimi - Dev,在SWE - bench Verified上以60.4%成绩获开源SOTA。参数量72B,编程水平强。采用MIT协议,权重和代码已发布。官方透露了部分关键技术,更多细节待后续报告。

量子位
新闻资讯7

一个数据集,一年产稿7876篇!AI强力加持,垃圾论文海量爆发

利用美国NHANES公共数据集,结合AI工具,研究者批量生产质量堪忧的论文。这不仅是技术滥用,更是科研评价体系扭曲的缩影。背后有论文工厂作祟,根源在于学术生态的扭曲。

新智元
算法论文8

ICML 2025 | 千倍长度泛化!蚂蚁新注意力机制GCA实现16M长上下文精准理解

在大语言模型发展中,长文本建模挑战大。蚂蚁研究团队提出注意力机制GCA,可端到端学习检索相关片段,实现长序列处理与泛化,其Triton kernel实现已开源,论文被ICML 2025接收。

机器之心
产品应用7

刚刚,OpenAI开放GPT-4.1偏好优化DPO,ChatGPT能真正学会你的「品味」了!

OpenAI宣布GPT - 4.1全系列模型支持DPO微调,可让AI通过对比回答学会用户偏好。介绍了DPO原理、适用模型、数据格式、创建任务方法等,还提及开发者反应与技术要点。

AGI Hunt