端到端神经网络」共找到 2363 篇相关文章

算法论文7

AI版盗梦空间?Claude竟能察觉自己被注入概念了

Anthropic最新研究发现LLM有内省迹象,Claude能察觉概念注入。研究用概念注入测试,虽模型内省能力有限且不可靠,但能力强的Claude Opus 4和4.1表现好,未来内省或更复杂。

机器之心
开源动态7

DeepSeek-OCR生态爆发!从前跨平台,解锁OCR新玩法!

近年来OCR技术应用广泛,DeepSeek-OCR开源后引发开发者关注。文章盘点其四个衍生项目,有轻量级前应用、Windows桌面应用、全Rust跨平台客户和专业PDF转换工具,覆盖多场景。

开源星探
算法论文8

大模型推理学习新范式!ExGRPO框架:从盲目刷题聪明复盘

上海人工智能实验室等团队提出经验管理和学习框架ExGRPO,能科学管理经验。与传统RLVR方法比,它在不同基准提升性能,尤其复杂推理任务,还揭示滚雪球效应,为模型推理训练提供新思路。

量子位
推荐文章7

“谈故障色变”有章可循:美图 SRE 故障应急与复盘实践

在 InfoQ 举办的 QCon 全球软件开发大会上,美图高级运维经理石鹏分享美图 SRE 团队故障应急与复盘实践,探讨故障应急各环节,剖析故障本质与原因,还交流 AIOps、LLM Ops 等技术。

InfoQ
8

从6人日1人日:一次AI驱动的客户需求开发实战

文章分享AI驱动客户需求开发实战,从实践活动汇总AI Coding问题,给出解决建议。以穿搭动态框架需求为例展示开发过程,对比效率提升300%,还探讨需求拆分、Prompt编写等问题,介绍业务开发范式。

阿里云开发者
新闻资讯8

从TransformerGPT-5,听听OpenAI科学家 Lukasz 的“大模型第一性思考”

2017年《Attention Is All You Need》提出Transformer架构,重塑AI版图。其作者“Transformer八子”中,Lukasz Kaiser加入OpenAI,参与GPT-4、GPT-5等研发。他10月将出席大会分享见解,曾预言多模态等趋势已渐成现实。

AI科技大本营
推荐文章7

从 Langchain Spring AI,我们究竟需要怎么样一个企业级 AI 开发基础设施?

文章指出AI Agent应用开发方式演变快,企业构建AI Agent体系面临挑战。介绍了AI Agent应用架构变化及趋势,如AI应用平台低代码效应、框架与平台双轨并行等,还总结了四类AI Agent框架及企业级框架平台核心考量。

phodal
产品应用8

谷歌发布Nano Banana官方保姆级开发教程,代码给你喂嘴边

谷歌为Nano Banana新模型发布官方保姆级开发教程。介绍了使用Google AI Studio免费测试方法,阐述环境准备,如获取API key、设置结算账户、安装Gen AI SDK,还展示代码实战,以及和模型沟通的技巧。

AIGC开放社区
算法论文8

基于LLM的Agentic Reasoning框架综述:从方面场景的全面总结

近年来,大型语言模型虽能力强但有局限,研究者构建基于LLM的智能体系统。此综述论文提出系统、统一分类法梳理智能体推理框架,建立统一描述语言和通用算法,分析其在不同场景表现与评估方法。

深度学习自然语言处理
算法论文8

从繁杂技巧极简方案:ROLL团队带来RL4LLM新实践

当前RL4LLM领域发展快但存在标准、结论不一及机制解释不足等问题。阿里巴巴淘天集团和爱橙科技联合高校基于ROLL框架研究,评估关键技术组件,提出简化算法Lite PPO,在多基准上表现佳。

机器之心