验证循环」共找到 960 篇相关文章

新闻资讯7

想进OpenAI?先解出这道题,百万美元算力已就位

OpenAI发起Model Craft Challenge「Parameter Golf」项目,要求在固定数据集上降验证损失,模型产物控制在16MB内,8张H100 GPU 10分钟完成训练。提供百万美元算力,6月招早期人才,挑战3月18日至4月30日。

机器之心
算法论文8

AI读不懂文档结构?计算所重构Agentic RAG文档推理能力

大语言模型工具使用能力推动RAG进化,现有Agentic Search框架有“结构盲”问题。中科院计算所团队提出DeepRead,将文档结构转化为坐标系统,用两大工具协同实现类人推理,在多数据集验证效果显著。

新智元
开源动态8

人形机器人「网球运动员」来了!不靠预编程,银河通用×清华破解长程打网球难题

银河通用与清华联合提出LATENT研究,使人形机器人通过深度强化学习自主习得网球对打能力,实现从“机械复刻”到“智能决策”跨越。该研究提出新运动学习方法,构建“运动小脑”等,经实验验证性能优越。

量子位
开源动态8

训练即服务!让模型训练回归算法语义,150行代码跑通RL

ModelScope团队开源Twinkle框架,采用Client - Server架构,支持20余种算法组件。开发者约150行代码就能编排复杂RL训练循环,底层调度等交给框架。它兼顾易用性与灵活性,有多种特点和优势,代码已开源。

量子位
算法论文8

DeepMind新论文炸锅:AI全自动进化算法,写出专家都想不到的解,网友:这可能就是“王牌”

谷歌DeepMind让LLM驱动的智能体AlphaEvolve改写、进化算法代码。选定CFR、PSRO框架,只开放关键决策逻辑给LLM,通过生成、运行、评估、筛选循环,进化出VAD - CFR和SHOR - PSRO算法,表现超人类手工版本。

InfoQ
算法论文8

Agent框架各自为战?谷歌&微软:用Agent-KB让经验自由流动

当前不同框架的Agent知识无法互通,谷歌、耶鲁、字节、oppo等团队联合提出Agent KB,这是通用记忆基础设施,能让异构Agent框架共享经验。它有师生双阶段检索机制,实验验证其能带来显著增益。

PaperAgent
推荐文章8

“AI 在一线:开发人员如何重塑软件开发流程” |圆桌讨论

文章是关于“AI在一线:开发人员如何重塑软件开发流程”的圆桌讨论,多位嘉宾分享了AI辅助工具对软件开发的影响,包括加速原型设计、缩短项目时间等,也提到了局限性和需注意的问题,如信任和度量标准。

InfoQ
算法论文8

VLM剪枝新SOTA:无需重训练,注意力去偏置超越6大主流方案

常用的attention机制存在位置偏置和padding异常,影响剪枝效果。上海大学曾丹团队提出无需重新训练的attention去偏方法,在多模型、剪枝策略及基准上验证有效,为多模态模型部署提供新思路。

新智元
新闻资讯8

45年数论猜想被GPT-5.2 Pro独立完成证明,陶哲轩:没犯任何错误

2025年1月17日,研究者Neel Somani让GPT-5.2 Pro解1980年提出的埃尔德什猜想第281号问题,证明经陶哲轩验证成立。此外,网友发现有更简单经典解法。陶哲轩提醒评估AI真实成功率有报告偏差。

量子位
产品应用7

对我来说,Claude Code 就是 AGI

作者分享项目中配置 Google Cloud Pub/Sub 服务的经历,以前手动或借助 ChatGPT 操作繁琐,现在用 Claude Code,只需描述问题,它就能自动完成分析、操作、验证等,作者认为其某种程度算 AGI。

AGI Hunt