与爱为舞」共找到 9344 篇相关文章

算法论文8

RL 效率无损飙升 3 倍:厦大-Shopee-清华联合首创,将投机解码首次引入 RL,推理能力稳如初!

传统RLVR训练中,rollout阶段耗时成瓶颈。厦大 - Shopee - 清华联合团队提出SPEC - RL,将投机解码引入RL,训练提速2 - 3倍,避免重复生成,主流算法兼容,在多项基准测试中性能稳定。

深度学习自然语言处理
算法论文8

让大模型合成检查器:UIUC团队挖出Linux内核90余个长期潜伏漏洞

伊利诺伊大学香槟分校张令明老师团队的论文提出KNighter,它让大模型生成静态分析检查器,在Linux内核挖出92个长期潜伏漏洞,将LLM归纳能力沉淀规则,带来可落地等好处。

机器之心
新闻资讯7

AI 项目总踩坑?小团队、渐进研讨带你找到正确打开方式

Cloud Native Summit 2025奥克兰大会探讨企业借Open Practice Library将协作模式转化成果。Andrea Magnorsky分享Byte - Sized Architecture方法,Ahilan PonnusamyAndreas Grabner介绍企业采用AI的迭代式框架,强调小规模持续研讨。

InfoQ
新闻资讯8

英伟达下一代GPU登场,Rubin CPX一次推理数百万Token,网友:这是头野兽

在周二的AI基础设施峰会上,英伟达宣布推出专超100万token长上下文推理设计的Rubin CPX GPU。它将其他产品组成新平台,性能卓越,还能复用现有平台,预计2026年底上市。

机器之心
算法论文8

清华校友出手,8B硬刚GPT-4o!单一模型无限工具调用,终结多智能体

MIT等机构推出TIM和TIMRUN组合拳,突破模型token天花板。TIM将推理建模任务树,TIMRUN优化内存管理。二者结合支持长程推理,实现单模型高效推理,简化智能体构建,在多方面表现出色。

新智元
新闻资讯7

27、42、73,DeepSeek这些大模型竟都喜欢这些数!什么?

技术作家发现GPT - 4o、Claude等模型猜数偏好42、73,Andrej Karpathy测试中模型多选27。网友猜测原因,如数据集、人类偏见等,也有论文分析此现象,多数据分布有关。

机器之心
新闻资讯7

Meta CEO X 微软 CEO 对话解读:「蒸馏工厂」何成开源的魅力之源?

Meta CEO Mark Zuckerberg 和微软 CEO Satya Nadella 在 LlamaCon 2025 闭幕会议对话,探讨AI对技术平台等影响,如使文档、应用和网站界限模糊,还谈及开源闭源模型战略价值及‘蒸馏工厂’概念。

机器之心
推荐文章7

任务自适应 Harness:从 Trace 到多 Coding Agent 的协作记忆

作者AI Coding准备的端到端方案未落地,后在Routa项目找到新落点。基于ACP协议的Agent Trace可记录关键行,用于分析优化。还介绍了Feature Explorer、Kanban Harness及任务自适应Harness,探讨多Agent协作记忆。

phodal
推荐文章7

AI时代的求生法则

文章指出AI时代逻辑改变,它淘汰工具人而非仅淘汰旧工具。以编程工具进化例说明AI智能化、自动化提升,影响多个行业。作者悲观看待普通人命运,给出三条求生法则:用先进AI工具、Vibe Coding、投资AI。

newtype AI
开源动态8

WAIC抢先爆料:金融“黑马”大模型超DeepSeek刷新SOTA,论文已上线

WAIC期间,蚂蚁数科金融推理大模型发布会未开,论文已上线。其新模型Agentar - Fin - R1有8B和32B版,在金融测评集超DeepSeek等,还兼顾专业通用,蚂蚁数科还提出评测基准Finova。

量子位