端到端神经网络」共找到 2369 篇相关文章

新闻资讯8

AI进化时间表已现!LLM每7个月能力翻倍,2030年职场不复存在?

LLM正飞速进化,METR研究发现其智能每7个月翻番。2030年,一个模型几小时就能完成人类工程师数月的工作。该研究提出“任务完成时间视野”指标衡量模型能力,不同模型表现差异大。

新智元
算法论文8

数学推理热潮下的冷思考!如何训练真正"全能"的推理模型?

论文评估20余个开源推理模型在多领域表现,发现多数模型数学成功难迁移。揭示微调方法(RL vs SFT)决定能力泛化,SFT像‘填鸭’,RL似‘思维健身’,为构建通用推理智能体提供新路径。

深度学习自然语言处理
推荐文章7

从后训练回预训练,LLM+RL 的潜力兑现有有机会走更远吗?

RL与LLM结合是重要技术方向,应用从后训练延伸至预训练。虽看似为LLM+RL带来希望,但RL本身有局限。微软等提出的RPT有潜力,不过训练语料等未广泛验证,且需大量计算资源。

机器之心
新闻资讯7

2025 AI Cloud 100 China榜单发布:6个赛道,34家新上榜,DeepSeek、Manus上榜

6月22日,靖亚资本等发布2025 AI Cloud 100 China榜单,聚焦GenAI商业落地企业。还发布行业趋势报告,总结融资、技术等情况,预测未来五大趋势,如AI应用从Copilot升级Autopilot等。

Founder Park
8

硅谷顶尖产品教练万字干货,一针见血揭示产品失败真相

文章回顾 Jim Morris 演讲,指出多数团队混淆“产出”与“成果”,迷恋“虚荣指标”。以 Power Reviews 为例,强调做对事才驱动客户价值。还介绍衡量成功的指标及应用案例,说明指标关联与先行指标作用。

AI科技大本营
产品应用7

火山引擎,「出击」Agent

2025 年年中大模型竞争进入下半场,Agent 成焦点。文章分析其 2B 与 2C 落地困境,介绍火山引擎新开发范式,如 TRAE、豆包大模型 1.6、PromptPilot 等,助企业解决 B 落地难题。

AI科技评论
开源动态8

轻量级语音模型Vui开源,支持本地部署,笑声停顿全拟真,4万小时练出人类对话感!

近日,Fluxions - AI团队在GitHub开源轻量级语音模型Vui,可设备运行。它能精准模拟语气词、笑声等,有三款模型,适用于语音助手、播客生成等场景,解决了传统模型的痛点。

开源星探
推荐文章8

LLM省钱大测评!48块GH200,首个百亿级参数量实证

EfficientLLM项目聚焦LLM效率,提出三轴分类法和六大指标,实验覆盖多方面。研究表明效率优化需权衡,最优策略因任务和模型规模而异,且相关技术可迁移跨模态模型,成果将开源。

新智元
算法论文8

港科联合港中文提出AdaCtrl,自适应可控Reasoning,可降10~90%

港科联合港中文提出AdaCtrl,解决LLM推理的过度思考、算力浪费和响应延迟问题。它有自适应和用户控制两种模式,通过两阶段训练法实现目标,实验效果好,未来或拓展多领域。

深度学习自然语言处理
开源动态8

2天1k多星!BAGEL横空出世:字节跳动发布全球首个多模态全能AI,开启智能新纪元!

字节跳动推出开源多模态基础模型BAGEL,有70亿活跃参数。它在多模态理解排行榜超顶尖开源模型,文本图像质量与SD3媲美,还具备世界建模等能力,文中介绍其方法、特性及使用说明。

GitHubStore