防护机制」共找到 948 篇相关文章

算法论文8

隐形束缚:RLVR为何无法突破LLM的推理边界?

大型推理模型进展依赖带可验证奖励的强化学习(RLVR),但它能否扩展模型推理能力存疑。本文通过理论证明与实验,揭示RLVR存在“隐形束缚”,只能在基座模型初始能力内优化,难以发现新解。

深度学习自然语言处理
新闻资讯7

OpenAI员工爆料:已抢先体验GPT-5!7月上线,疑似完全多模态

新智元报道,X上神秘爆料与网友灰度测试经历让GPT - 5讨论再升温。奥特曼称今年夏天可能推出,迈向完全多模态。此外,还提及OpenAI核心团队动态、出走高管新动作及AI发展风险与监管建议。

新智元
新闻资讯7

疯狂……韩国开发出强大的核灾难处理人形机器人。丑,但实用

韩国原子能研究院正开发用于核灾难响应和废料处理的人形机器人,目标是能举200公斤重物。与其他机器人相比,其举重能力优势明显。不过在真实核灾难现场应用还需长期测试。

AGI Hunt
新闻资讯7

AI的“铟”谋:暴涨的稀散金属,正在反噬谁?

AI虽未必造成铟短缺,却改变其未来价值预期,投机资金借此炒作,使铟价脱离产业实际。铟在总量上有盈余,但高纯铟产能不足,且市场流通盘小,价格被炒高,给中国制造业带来阵痛。

芯师爷
新闻资讯7

“额度想重置就重置,不问财务”,Codex Tibo首曝幕后:产品没做好,就补偿用户

围绕 Codex 与 Claude Code 使用额度问题,社区不满额度机制不透明不可预测。Codex 团队 Tibo 公开额度重置逻辑源于补偿,并非营销。此外,还谈及产品融合、技术创新、算力决策等多方面内容。

InfoQ
算法论文8

GAIR Paper 107|高校联合腾讯发布 GameCraft-Bench:AI已能端到端开发游戏,Claude Opus 四成达到可玩水平

香港中文大学(深圳)等高校联合腾讯发布 GameCraft-Bench,旨在构建基于真实游戏引擎、产物完整可运行且能验证的 AI 游戏生成评测基准,解决现有基准难衡量端到端可玩性的问题,测试显示前沿模型在游戏生成上仍薄弱。

AI科技评论
7

DeepSeek V4还能更省!新工具缓存命中率高达99.82%,2折稳定到手

DeepSeek V4系列发布1个月,官方永久降价,开源社区的Reasonix项目将缓存命中率干到99.82%,能大幅降低成本。它专为DeepSeek打造,实现思路基于其缓存机制,安装使用简单。

量子位
算法论文7

近期,不错的LLM Agent统一记忆框架综述~

随着GPT、Qwen、Claude等大模型能力提升,LLM-based Agent走向长期任务。论文提出统一框架拆解Agent Memory为四组件,围绕两个数据集复现比较10个方法,还设计出新的低token开销框架。

PaperAgent
算法论文8

Agent不是关键!人大AiScientist实现23小时、74轮长程记忆

中国人民大学团队打造的AiScientist,旨在解决长程机器学习研究工程的持续性难题。它通过File - as - Bus机制稳定保存项目状态,在多轮实验中表现出色,提升科研效率,推动AI真正接手科研流程。

新智元
推荐文章8

白春礼:人工智能促进科学研究范式变革

白春礼在浦江论坛探讨AI对科研范式变革的影响。他指出,当下科学研究体系面临发现机制、组织方式、知识生产方式的结构性重组,呈现新特征,同时也面临竞争、组织变革等挑战。

力学与人工智能