任务特化训练」共找到 3678 篇相关文章

新闻资讯7

00后打造最强苹果开发Agent!刚刚,OpenAI打包收编

今天凌晨,Xcode最流行的编程Copilot插件Alex被OpenAI收编,团队加入Codex。Alex是Xcode亮眼插件,能实现自动化开发任务。其创始人是00后,经验丰富。OpenAI此举或为扩大在苹果生态影响力。

新智元
算法论文8

英伟达发布 Jet-Nemotron 系列小模型,理论最大加速比 56 倍

英伟达发布 Jet - Nemotron 系列小模型,在多项基准测试中表现出色,实现高吞吐量加速和高准确率。其训练采用 PostNAS 方案,对既有模型针对性优化,展示了在小模型优化上的可行技术路径。

AI科技评论
推荐文章8

Physical Intelligence 核心技术团队分享:物理世界的“Vibe Coding”如何实现?

Physical Intelligence 核心技术团队解读机器人技术路径,分享前沿探索。介绍 VLA 与 VLM、LLM 关系,还提及 PI 构建数据管线、提出“知识绝缘”机制,分析开放世界部署难题,展望未来“机器人模型即服务”。

海外独角兽
新闻资讯7

AI 狂潮中,电子业破局:国产先进封装加速突围

AI应用渗透使算力需求结构重塑,传统芯片技术升级遇阻,先进封装技术成关键。文中介绍DeepSeek架构突破、DeepSeek - R1算法革新,分析其对算力需求的影响,指出高性能算力芯需求仍高,先进封装能释放芯片性能,国产有望突破。

芯师爷
算法论文7

从BERT到T5再到Qwen3:关于Embedding的八点总结

哈工大30+页综述聚焦通用文本嵌入(GPTE),系统介绍其架构、数据、模型,探讨预训练语言模型(PLM)给GPTE带来的基础能力与高级扩展,还涉及多模态、多语言、代码嵌入等应用。

PaperAgent
产品应用8

马斯克挖不动的清华学霸,一年造出 “反内卷 AI”!0.027B 参数硬刚思维链模型,推理完爆 o3-mini-high

新加坡 Sapient Intelligence 推出小型模型 HRM,参数仅 2700 万却能解决复杂推理难题,其不依赖“思维链”,借鉴人类大脑工作方式。该模型准确率超先进思维链模型,推理能力强,具经济性,可提升任务效率。

InfoQ
新闻资讯8

挤不动的世界机器人大会上,自变量秀出了真·通用具身智能

2025世界机器人大会上,自变量机器人展示多项成果。通用轮式双臂机器人“小量”“小白”能完成制作香囊、家务整理等任务;“量子2号”仿人形机器人动作精准自然;其具身智能基座模型WALL - A有强大泛化性。

机器之心
算法论文8

MeanFlow再下一城,北大提出机器人学习新范式MP1,实现速度与成功率双SOTA

北大研究团队提出机器人学习新范式MP1,将MeanFlow引入机器人学习,实现毫秒级推理速度。还引入分散损失提升少样本泛化能力,在仿真和真机测试中,实现速度与成功率双SOTA。

机器之心
开源动态8

斯坦福开源复杂推理AI Agent,融合超10种工具

传统AI助手应对复杂任务能力有限,斯坦福开源OctoTools,这一复杂推理AI Agent融合11种工具。它在16项基准测试中准确率高,能应对多领域复杂场景,框架含工具卡片、规划器等构件。

AIGC开放社区
算法论文7

递归神经网络的复兴:Mixture-of-Recursions

Google DeepMind研究者设计的语言模型,能判断关键单词并进行深度递归计算,通过轻量级“路由器”节省计算资源,在同等训练成本下表现显著优于传统模型,文中还提及其他解决动态算力分配问题的思路。

PaperAgent