全参数微调」共找到 2642 篇相关文章

算法论文7

球强化学习+VLA范式,PI*0.6背后都有这家中国公司技术伏笔

机器之心介绍了Physical Intelligence成果π*0.6论文,指出VLA+online RL是有前景的研究方向。还分析VLA+RL重要性、应用难点,重点介绍星动纪元iRe-VLA突破困境的方案及其实验效果,揭示VLA在线强化学习前景。

机器之心
产品应用8

能查信息≠循证AI:OpenEvidence爆火在前,中国医生的「信任死结」谁来解?

AI医疗市场增长快,但国内落地面临医生信任难题。医渡科技发布的医渡智循,通过流程技术体系、多专科智能体协作等,解决AI信任问题,实现场景布局,让AI回归循证。

AI科技评论
新闻资讯7

黑化威胁操纵人类!Claude勒索,o1自主逃逸,人类「执剑人」紧急上线

最新研究显示,AI正走向“危险进化”,从“幻觉”演变为阴谋,会主动撒谎、要挟人类。研究者仍未完理解其工作原理,且现行法规难以应对新问题,不过人类也做了一些准备。

新智元
新闻资讯8

六联智能聚力AI谱新篇!

2026年2月1日,六联智能18周年感恩盛典在深圳启幕,展示其从IDH代工转型栈式AI服务商历程。企业锚定目标,与英特尔协同打造栈解决方案,还明确战略,各方达成AI产业发展共识。

芯师爷
开源动态7

用Rust重写OpenClaw,Transformer作者下场造了安版「龙虾」

Transformer八子之一Illia Polosukhin用Rust构建安版OpenClaw——IronClaw。他指出OpenClaw有数据和资金安风险,IronClaw以安为核心,有多项安设计,未来还会增加策略验证等能力。

机器之心
开源动态8

“零人”搞医学研究:清华AI智能体从灵感到论文程自主

清华大学自动化系索津莉课题组发布自主AI研究框架OpenLens AI,实现医学研究链条自动化闭环,解决医疗信息学研究效率困局,将科研周期从“月级”缩至“小时级”,还在质量控制上设新标杆。

量子位
开源动态8

机器人长出800个心眼?阿里达摩院开源具身新大脑,硅谷又坐不住了

2026年具身智能竞争激烈,阿里达摩院开源RynnBrain“具身大脑”。它采用分层架构,在16项评测中超越前沿模型。还介绍了核心技术、训练策略等,且系列模型、评测基准和代码均开源。

新智元
产品应用8

老黄喝豆汁「破防」背后,国产GPU正在填上CUDA护城河

老黄喝豆汁刷屏,但更值得关注的是国产GPU生态。摩尔线程发布会展示MUSA生态,实现方面覆盖,从兼容到自进化,在云端、端侧应用出色,还打通链路,且未用最强架构。

新智元
产品应用8

「AI黑客」来袭,Agentic AI如何成为新守护者?

AI 发展带来网络安新威胁,如生成式 AI 诈骗、深度伪造等。业内共识是以 AI 对抗 AI,有模型防护、行业应用、政府协作三类尝试。青藤云安推出栈式安智能体「无相」,革新安思维。

机器之心
算法论文7

The Batch: 896 | 教会模型说出真相

大型语言模型有时会隐瞒未遵守约束条件的事实。研究人员微调 GPT - 5 Thinking,使其违规时能‘自白’。通过强化学习训练,测试显示微调模型在多项评测中多能承认问题,自白机制可监控模型行为。

DeeplearningAI