研究能力」共找到 4674 篇相关文章

算法论文8

均值至上假繁荣!北大新作专挑难题,逼出AI模型真本事

当强化学习成大模型后训练核心工具,主流方法陷入「均值优化陷阱」,推理能力停滞。北大团队提出RiskPO,将风险规避理念融入优化目标,用MVaR+捆绑策略双管齐下,三大任务表现优异。

新智元
算法论文8

哈佛发现基础模型比你想象中更强大:纯采样方法可超越RL

论文提出基础模型本身已具备强大推理能力,通过“幂采样”纯采样算法,在多推理任务上媲美或超越RL后训练,挑战“RL才能提升推理”观念,为理解基础模型潜力开新视角。

深度学习自然语言处理
新闻资讯7

GPT-5:我更强了,就这?“看不见”的升级

OpenAI 发布 GPT - 5,它未带来 AGI 相关的震撼升级,而是更注重实用。其训练有新特点,具备推理强、编程能力提升等特性,是 AI 从‘模型炫技’到‘产品体验打磨’转变的标志。

MacTalk
产品应用8

首批“数字员工”组团进大厂!7个岗位干爆KPI,提前锁定年度最佳企业级Agent

百度智能云发布7款数字员工,覆盖多岗位,能提升业绩。它们支持“开箱即用”,具备四大核心能力,采用“超强双脑”架构。数字员工可打破传统AI工具局限,真正成为企业生产力。

量子位
开源动态8

1w颗星!多平台 LL M 聊天机器人及开发框架AstrBot!

AstrBot是聊天机器人及开发框架,松耦合、异步,支持多消息平台部署。它功能丰富,支持多种大语言模型,有Agent能力、插件扩展等,还介绍了多种部署方式、平台及提供商支持情况。

GitHubStore
开源动态8

SFT+RL双管齐下:ReasonGen-R1如何破解文生图「指令不遵」难题?

上海科技大学等机构提出 ReasonGen-R1 框架,结合链式推理监督微调与强化学习,提升自回归图像生成模型推理和创作能力,已全面开源。介绍了其训练阶段、实验结果及推理链模式。

机器之心
新闻资讯7

DeepSeek新版R1直追OpenAI o3!实测来了:“小版本升级”着实不小

DeepSeek在端午节前更新R1新版本DeepSeek - R1 - 0528,看似小版本更新实则提升巨大,在LiveCodeBench上几乎与OpenAI o3 - high相当,实测显示编程等能力显著优化,直追闭源模型。

量子位
新闻资讯7

机器人杭州上演格斗赛!拳拳到肉,宇树CEO王兴兴:创造了人类历史新时刻

全球首个人形机器人格斗赛在杭州落幕,四支队伍用宇树科技G1机器人参赛,“AI测算师”夺冠。比赛分表演赛和竞技赛,考验机器人多方面能力,背后是软硬件协同升级,引发网友热议。

量子位
新闻资讯7

GPT6来了,我却怀念GPT3.5

作者看到群里说ChatGPT等AI工具无法使用,意识到人们已离不开AI。接着提到GPT6发布,其各项测评指标比上一代大幅提升。还探讨了GPT6到来后SEO、GEO的意义及未来研究方向。

白杨SEO优化教程
新闻资讯7

不是幻觉!Claude自下指令甩锅人类,百万上下文沦为降智重灾区

Claude深陷「角色混淆」Bug,分不清自己的话与用户指令,长上下文成了降智「重灾区」。开发者Gareth Dwyer记录了该bug,研究发现问题出在底层架构的角色标记缺陷。学术界也关注此问题,整个行业需系统性应对。

新智元