经验工程化」共找到 1779 篇相关文章

算法论文8

AlphaGo之父找到创造强学习算法新方法:让AI自己设计

谷歌DeepMind团队在Nature发表论文,探索AI自主发现强学习算法的可能。团队负责人是“AlphaGo之父”David Silver 。方法是基于智能体经验元学习,实验显示自动发现的规则表现优异,未来强学习算法或无需人工设计。

机器之心
算法论文8

仅100种子题,合成数据质量超GPT-5,阿里、上交提出Socratic-Zero框架

阿里巴巴与上交大联合提出 Socratic-Zero 框架,仅从 100 个种子问题出发,通过三智能体协同进生成高质量课程。该框架合成数据质量超 GPT - 5 等,Solver 性能提升显著,工程友好,开启零数据自进新路径。

机器之心
算法论文8

长文本生成迎来新突破:拓元智慧推出 DrDiff ,实现效率与质量双提升

拓元智慧联合多团队开发出 DrDiff 框架,解决长文本生成中效率与质量难兼顾问题。其核心是“动态”,有分层稀疏注意力、动态专家调度、语义锚点状态三个创新组件,经测试表现良好,未来应用值得期待。

AI科技评论
新闻资讯8

Vibe之下,AI之上:海淀创新生态的“社区”引力法则

2025年9月17 - 21日,2025 AI创造者嘉年华在海淀中关村创业大街举办。活动由多单位联合主办,含五大板块,呈现年轻、社区、跨界融合特点。它是读懂海淀AI实力的入口,体现其在AI科研、技术研发等方面的优势。

量子位
推荐文章7

Vibe Working:AI Coding 泛的终局想象 |AGIX PM Notes

文章围绕AI领域展开,探讨“Vibe Working”在AI编码及更广泛场景的应用,介绍工作流管理产品;还提及全球市场动态、多起AI相关商业合作与交易,以及ETF分红知识。

海外独角兽
开源动态8

交互扩展时代来临:创智复旦字节重磅发布AgentGym-RL,昇腾加持,开创智能体训练新范式

学习之父指出人工智能迈入「经验时代」,在此背景下,复旦、创智、字节研究者发布 AgentGym - RL 框架。它是全新端到端 RL 框架,提出 ScalingInter - RL 方法,7B 模型经训练追平顶尖商业模型,为 AI 发展注入动力。

机器之心
开源动态8

三大核心创新公开,快手开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!

快手开源多模态Keye-VL 1.5,为8B视频理解最强模型,公开3大核心创新技术。它靠Slow-Fast视频编码等,在20+基准屠榜。在多类基准测试和内部测评中表现优异,将业务经验沉淀到开源社区。

PaperAgent
算法论文8

自搜索强学习SSRL:Agentic RL的Sim2Real时刻

本文由多机构联合完成,引入自搜索强学习SSRL。它利用结构prompt和format reward提取模型world knowledge,降低幻觉。还探索Sim2Real有效性,验证SSRL训练模型在真实场景泛性,且所有训练数据等已开源。

机器之心
新闻资讯7

AI系统10分钟生成CVE漏洞利用程序:网络安全攻防战进入“分钟时代”

研究人员开发的AI系统能10 - 15分钟生成CVE漏洞利用程序,成本约1美元,准确性和可靠性高。此外,HPTSA系统可利用零日漏洞。传统网络安全防御模式失效,攻防失衡加剧,AI攻防对抗趋势明显,有专业、自主、高强度特点。

AIGC开放社区
新闻资讯7

AI 颠覆的第一个职业是程序员?|GAIR Live

文章围绕“AI颠覆的第一个职业会是程序员吗”展开讨论。嘉宾认为AI Coding尚处早期,有潜力成新工程范式。它面临“幻觉”、上下文窗口限制等瓶颈,未来开发者角色或转变为“业务翻译者”和“需求架构师”。

AI科技评论