大厂自研」共找到 5836 篇相关文章

8

AI真的需要「像人类」那样思考吗?AlphaOne揭示属于模型的「思考之道」

近年模型在推理任务有进展,但缺乏推理节奏调控能力。伊利诺伊学厄巴纳 - 香槟分校和加州学伯克利分校研究提出 AlphaOne 框架,引入 α - moment 实现无需训练的推理调控,实验显示其能提升准确率和效率。

机器之心
产品应用8

1人顶1个Infra团队!OpenAI前CTO新招,让模型训练跌成白菜价

模型训练正从‘作坊炼丹’进化为‘工业微调’。OpenAI前CTO创立的Thinking Machines Lab推出Tinker,潞晨云微调SDK兼容其范式,实现算法设计与基础设施解耦,降低成本,提升人效,适用于多场景。

新智元
算法论文8

模型人格可以被量化!Anthropic最新论文发现“辅助轴”,开辟人类控制AI全新道路

Anthropic等机构研究团队深入模型激活空间,发现模型人格可量化,存在“辅助轴”。沿此轴干预能预测、解释“人格漂移”,用“激活上限”技术稳定模型行为,抵御越狱攻击,开辟人类控制AI新道路。

AI寒武纪
新闻资讯8

从它石智航的世界纪录里,我看到了具身模型落地干活的希望

在上海AWE展会,它石智航的A1机器人获“机器人在一小时内装配亚毫米级线束最多次数”吉尼斯世界纪录。这得益于它石研通用具身模型「AWE3.0」,该模型实现多项突破,推动具身智能落地。

AI科技评论
算法论文8

赵恒爽团队论文:让扩散模型既拿高分又不「作弊」丨CVPR 2026

扩散模型虽能生成逼真图像,但存在“奖励作弊”问题。港赵恒爽团队提出 GDRO 后训练方法,引入组级奖励优化机制,提升模型表现、缓解作弊,还提高训练效率,有明显工程价值。

AI科技评论
算法论文8

腾讯与中科院联合提出R-4B,一个能动决定是否思考的多模态模型

多模态语言模型“始终思考”模式有缺陷,腾讯混元团队与中科院动化所联合提出R - 4B,通过双模式退火训练和双模式策略优化实现动思考,在多评测中达SoTA,省资源且效果好。

深度学习自然语言处理
算法论文7

小扎「梦之队」首批论文上线!LLM举进化,单步性能狂飙22%

Meta超级实验室MSL新论文探索用强化学习微调语言模型。提出探索迭代(ExIt)法,基于RL动课程学习,训练仅需单步任务,模型学会多步我改进。在MLE - bench上,ExIt相对GRPO提升约22%。

新智元
开源动态8

能让DeepSeek进化的Harness!LlamaFactory作者开源新工具:0.2元动造Agent

LlamaFactory作者郑耀威团队开源的PenguinHarness,是全球首个支持多Agent进化的Harness,能动构建、评测和改进Agent。它成本低、速度快,适配众多模型,还有严格契约保障安全。已在生产场景应用,效果显著。

机器之心
开源动态8

阿里云通义点金发布DianJin-R1金融领域推理模型,32B模型荣膺榜首

阿里云通义点金团队与苏州学合作推出DianJin-R1金融领域推理模型,介绍其开源数据集与模型、基于通义点金平台的数据合成,展示了其在性能测试中的优异表现,推动金融科技智能化进程。

机器之心
算法论文7

Nature重磅研究:模型让你变得更聪明还是更笨了?创造力增强还是扼杀了?

然》研究表明,语言模型对创造力的影响取决于任务。简单任务中,它像灵感助推器,分担认知负荷;复杂任务里,易致‘创意固化’,长期依赖还可能使脑‘变懒’。需按需调节使用。

AIGC开放社区