GPT5.4」共找到 3192 篇相关文章

算法论文8

阿里:RL强化LLM推理,是技巧还是陷阱?

近年来,强化学习(RL)成为解锁大型语言模型(LLM)复杂推理能力的关键工具,但该领域也面临技术选择困境。阿里联合多所高校的论文通过大规模可复现实验,揭示主流RL技巧的机制与适用场景,还发现极简组合(Lite PPO)性能超越复杂方案。

深度学习自然语言处理
推荐文章8

《AI 2027》揭秘:人类会被超级智能取代吗?等等,还有另一个结局!

《AI 2027》由Daniel Cocotal团队发布,精准预测了多项AI发展。报告推演2025 - 2027年AI智能体发展,不同阶段影响各异,还给出两种结局,一是AI重塑世界,二是人类控制住AI并发展安全系统。

新智元
算法论文8

如何将LLM的"思考习惯"迁移到视觉领域?

传统多模态模型处理复杂视觉推理能力不足,OVR团队以Qwen2.5 - VL - 7B为基础构建开源强化学习框架,成果模型OVR在12个基准测试刷新记录,揭示认知行为跨模态迁移三条黄金定律。

深度学习自然语言处理
新闻资讯7

OpenAI收购Windsurf失败

Techcrunch消息,谷歌聘请Windsurf的CEO等成员加入DeepMind团队,Windsurf被Cognition收购,OpenAI收购计划失败。Windsurf此前已筹超2亿美元,曾估值12.5亿美元,吸引OpenAI以30亿美元收购。

AIGC开放社区
7

华科校友在港冲刺AI infra第一股!已是中国最能赚的独立边缘云服务商,王小川天使轮就投了

PPIO派欧云作为独立分布式云计算服务商,是AI云计算服务先行者,近期在港交所递交招股书。它由华科校友创立,获王小川等投资,业务分边缘云与AI云计算,虽亏损但现金储备足,看好分布式云计算市场。

量子位
算法论文8

性能提升11.74%!腾讯优图提出激励推理,专攻复杂指令

现有大语言模型处理复杂指令能力不足,腾讯优图研究团队提出激励推理方法。该方法能提升LLM处理复杂指令表现,在1.5B参数LLM上性能提升11.74%,媲美8B参数模型。

量子位
新闻资讯7

天塌了,Claude 全面断供Windsurf!CEO喊冤控诉也挡不住开发者退订,祸起OpenAI收购?

当地时间6月4日,Anthropic切断Windsurf对Claude 3.x模型的直接访问权限。此前Anthropic也曾拒绝为Windsurf提供Claude 4系列模型支持。有观点认为这或与OpenAI收购Windsurf有关,目前双方未承认。

AI前线
开源动态9

7名博士生仅用3个月从零训练7B大模型:代码+数据+训练日志全公开

北京中关村学院7名跨专业博士生,耗时3个月从零训练出7B参数大模型ZGCM-1,采用数百个Agent协作实践AI4AI研发范式,全程公开代码、数据、权重、训练日志,分享一线实战经验。

量子位
新闻资讯8

硅谷今日最热具身模型!不用后训练,看一遍就学会

北美具身初创Skild AI发布全新机器人基础模型S1,主打上下文学习,能看示范视频完成复杂操作。在未见过任务上成功率达66%,远高于传统方法。其发展或让开发机器人技能像给ChatGPT写Prompt。

量子位
产品应用8

刚刚,马斯克终极大招Grok Bot来了!

SpaceXAI发布Grok Bot早期测试版及将发布4.6版本。它是云原生AI Agent,能24小时工作、多Bot并行协作,还能跟班学习。它是600亿收购Cursor的成果,对标Anthropic的Claude Cowork。

新智元