「科研新范式」共找到 4297 篇相关文章
突破Pass@1瓶颈:一种让LLM自我博弈、永不枯竭的RL新范式,超越基线22.8%!
近年来,基于可验证奖励的强化学习(RLVR)在提升大型语言模型(LLM)推理能力上有关键作用,但存在熵崩溃问题。论文提出SVS创新策略,让模型自我合成变分问题形成自我提升循环,实验效果惊人。
Anthropic发布Fable 5.1:科研、编程能力翻倍,成本最高降45%
当地时间9月1日,Anthropic推出Claude Fable 5.1和Claude Mythos 5.1。Fable 5.1科研、编程能力翻倍,成本最高降45%,还能解决实际问题,此次模型竞争转向多方面综合较量。
聊天框之外,AI 交互正在被哪些「新界面」重写?
近期,「理想的 AI 交互形态」引发热议。目前流行的聊天对话框式 AI 交互有局限,一些产品开始在特定场景引入不同交互设计。文章还分析了多数 AI 产品界面停留在聊天框的原因及业界探索新交互机会的情况。
openJiuwen社区开源新招:重磅发布JiuwenSwarm,拉开群体智能“养蜂”序幕
openJiuwen社区开源蜂群智能体JiuwenSwarm,落地Coordination Engineering范式。它有全栈技术体系,支持人以HOTS和HITS模式参与协同,实战效果佳,且在评测中表现亮眼,全套能力开源。
测试时也能RL,英伟达等提出全新范式:TTT-Discover
近日,斯坦福、英伟达、Together AI 等联合开源全新测试时新范式 TTT - Discover,在测试阶段用强化学习微调模型,以刷出 single best 结果,用几百美元就刷新诸多领域 SOTA。
刚刚,OpenAI 发布 GPT‑5-Codex 新模型,专为编程而生
OpenAI 发布专为 Agent 编程优化的 GPT-5-Codex 新模型,在动态思考、性能、代码审查等方面表现出色。同时,Codex 平台大升级,集成 GitHub,保障安全隐私,还公布了定价与可用性。
Claude Science几周干完两年活,10倍科研提速真来了?
2026年6月30日,Anthropic发布Claude Science,定位面向科学家的AI工作台。它将科研拆成可审计流水线,整合工具链,自带可追溯代码,有协调与审查智能体,首落生命科学领域,与Google、OpenAI玩法不同。
17000字Claude 系统提示启示:Karpathy 揭秘LLM 学习缺失“第三范式”
Andrej Karpathy提出LLM学习范式缺失‘系统提示词学习’环节。他观察Claude约17000词的系统提示词,认为目前问题解决策略多靠人工写入,理想情况应通过该学习产生,这也引出诸多待明确细节和新问题。
让Skill“有图可依”:openJiuwen首发多模态Skill范式Skill-Omni
openJiuwen社区发布业界最早工程化落地的多模态Skill范式Skill-Omni,让Agent经验从‘读得懂’升级为‘看得见’。它能将网页和视频视觉知识沉淀为多模态Skill,还介绍了生成及读取方式和适用任务。
独家丨前毫末智行CEO顾维灏创业,成立机器人新公司
AI科技评论独家消息,前毫末智行CEO顾维灏成立「紫星勤行」,布局酒店服务机器人赛道。他是老百度人,曾深度参与百度Apollo项目,毫末智行曾获多轮融资,现他在新赛道寻可能。