研究与产品」共找到 8021 篇相关文章

算法论文8

当SFT遇上RL:基于样本学习阶段的动态策略优化机制

在大模型推理能力增强研究中,SFT和RL两种后训练范式难有效融合。研究团队提出DYPO动态策略优化方法,先判断样本学习阶段再匹配优化路径,在多场景实验中表现出色,不过有实验边界。

量子位
新闻资讯8

辛顿警告AI将取代人类工作,杨立昆反对:应该先听这5个人怎么说

最近,“AI教父”辛顿警告AI将取代人类工作,指出AI以往技术不同,会突破人类智力瓶颈。但杨立昆反对,建议听五位经济学家观点。这五位学者对AI人类工作关系看法不一,却都认为这是经济问题。

DeepTech深科技
开源动态7

我给 OpenClaw 杀了 47 次僵尸进程,终于想明白了一些事

作者分享使用OpenClaw的经历,吐槽其部署、二开及钉钉通道集成问题,分析它火的原因,对比本地云上沙箱模式,反思Skill传统Agent工程、AI交付品局限,指出AI应用工程化仍重要。

阿里云开发者
开源动态8

超越GPT-5.2和Gemini-3-Pro!商汤多模态搜索、推理模型开源

商汤开源多模态自主推理模型SenseNova - MARS(8B/32B双版本),它通过强化学习整合工具,在多模态搜索推理测试中超越Gemini - 3 - ProGPT - 5.2,还采用创新算法稳定训练,构建新基准评测。

AIGC开放社区
算法论文8

斯坦福×英伟达发布AI推理新范式,刷新了多领域SOTA

斯坦福英伟达联合发布论文 TTT - Discover,提出新范式,不追求通用,在推理阶段针对特定难题修改模型参数。它战绩辉煌,但成本高、是偏科生且需打分器,其出现是技术哲学的突破。

新智元
产品应用8

MiniMax把自家“实习生”放出来了!

曾经割裂需求、设计代码的流水线正在消融,MiniMax上线的AI原生工作台Agent 2.0为此而来。它通过Desktop AppExpert Agents两大载体,可嵌入工作环境,现已开启封闭内测,能帮用户提升工作效率。

量子位
算法论文8

为什么Agent总是Demo猛如龙实战一条虫?

一篇51页论文研究主要智能体,指出适应性是关键。它提出2×2分类框架将适应方法分四大范式,还明确不同范式优缺点,发现T2范式数据效率远超A2。最后点明Agent适应性研究的四个前沿方向。

量子位
新闻资讯7

工作场景AI化,一个月花100美元订阅AI工具值吗?

AICon 全球人工智能开发应用大会 2025 北京站即将召开,InfoQ 直播栏目邀请来也科技胡一川、阿里汤威、美团邹明远、快手王东旭探讨 AI 时代「10x 个体」「10x 组织」,分享落地路径、效率提升及工具使用经验。

AI前线
新闻资讯7

OpenAI史上最大失误:放走这位MIT学霸!美国AI「三朝元老」,现实韦小宝

AI时代算力竞赛正酣,Anthropic联合创始人Tom Brown称其规模超阿波罗曼哈顿计划。他曾在OpenAI参打造GPT - 3,后团队决裂创立Anthropic,推出Claude并获市场认可,还分享了对年轻人的建议。

新智元
开源动态8

标准化3D生成质量榜单来了!首创层次化评价体系,告别“谁的demo更吸睛”主观评估

Hi3DEval团队推出面向3D内容生成的全新层次化自动评测体系Hi3DEval,设计对象级、部件级材质主题三层评测协议,在HuggingFace发布首期3D生成榜单,涵盖30个主流前沿模型。

量子位