「研究任务」共找到 3569 篇相关文章
BesiegeField:LLM能否学会设计机器?
香港中文大学推出基于游戏《Besiege》的测试平台BesiegeField,探讨LLM能否学会设计机器。研究通过组合式机器设计视角,测试LLM,提出多智能体迭代设计流程等,发现LLM有挑战但并非不可实现,如Gemini 2.5 Pro表现不错。
Sutton判定「LLM是死胡同」后,新访谈揭示AI困境
强化学习之父Rich Sutton直言LLM是死胡同,因其无法从持续实际互动中学习,违背他坚持的原则。在新访谈和圆桌讨论中,多位专家碰撞观点,探讨AI研究问题、强化学习困境及LLM发展走向等。
让大模型学会“像人一样”查证真伪
伊利诺伊大学香槟分校等校研究团队提出训练框架Veri - R1,为大模型提供“在线查证”新范式。它借助在线强化学习、精细化奖励机制和高质量数据,让模型学会像人一样查证,在多数据集上表现出色。
英伟达:RLP 让 AI 在预训练时就学会思考
英伟达研究团队发布 RLP 技术,与传统大语言模型训练不同,它在预训练阶段就让模型学会'先想后说'。通过奖励机制自我监督,实验效果惊人,性能提升显著,不挑数据,打破了大模型训练范式。
社区供稿丨MiniCPM-V 4.5 技术报告正式出炉
上个月开源的多模态模型 MiniCPM-V 4.5 广受好评,今日其技术报告出炉。报告从架构、数据和训练三方面探索高效路径,提出三大技术,使模型在多任务上突破,小参数规模下性能和推理速度佳。
DeepSeek新大招曝光:下一步智能体
知情人士爆料,DeepSeek正开发有更强AI Agent能力的新模型,预计年底推出。此前DeepSeek-V3.1已具备更强Agent能力,在工具使用与智能体任务中表现提升。业内对其入局智能体看法不一。
我们都错怪GPT-5了,路由统一算力,免费用户也能创造收益
GPT - 5发布后,其路由架构备受关注。开源社区的Arch - Router类似其路由系统,能结合任务领域和动作制定策略。GPT - 5路由框架可平衡成本与性能,还能转化免费流量,未来想掌控用户与模型交互路径。
1亿美元买不走梦想!但只因奥特曼这句话,他离开了OpenAI
全球AI军备竞赛烧掉3000亿美元,但真正研究「对齐问题」的人不足千人。Anthropic核心成员Benjamin Mann揭秘,2020年底OpenAI安全团队因安全优先级降低集体出走。他拒绝扎克伯格1亿美元邀约,强调AI要把安全放首位。
从烧光现金、裁掉一半员工,到 ARR 9 个月破亿:Replit用“全栈平台”反杀Cursor,赌赢“每层都赚钱”模式
2024年初到2025年9个月内,Replit年度经常性收入从不到1000万美元破亿。其增长靠系统性战略,以AI编程代理获客,后端基础设施变现。它反映AI编程工具从编辑器进化为平台的趋势。
5Y News|赜灵生物完成近4亿元B+轮融资
近日,赜灵生物宣布完成近4亿元B+轮融资,由启明创投领投。资金用于推进创新药临床研究和拓展新管线,强化三大核心技术平台。公司已有核心产品进入关键临床阶段,创始人称2025年将加速海外布局。