企业 LLM」共找到 2159 篇相关文章

开源动态8

OpenAI携手五巨头开源革命性超算协议:一举解决超大集群LLM训练不稳定和网络性能难题

OpenAI联合英伟达等五巨头推出超算开放网络协议MRC并正式向行业开放。MRC目标是性能可预期,有多平面网络、自适应包喷射、SRv6源路由三大核心机制,已在OpenAI多台超级计算机上部署。

AI寒武纪
算法论文8

LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制

中国科学院自动化研究所与腾讯AI Lab团队,从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上表现优于传统算法。

PaperAgent
算法论文8

LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制

中国科学院自动化研究所、腾讯AI Lab团队从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上性能显著优于传统算法。

深度学习自然语言处理
推荐文章8

Openai-o3 做不到的事,7B 模型做到了! 推荐系统“慢思考”,广告收入暴涨 4.1%

随着GPT - 4等大语言模型兴起,LLM用于推荐系统遇瓶颈,当前方法停在‘System - 1思维’阶段。A4ec框架把LLM从‘快思考’升级到‘慢思考’,用7B模型实现推荐系统升级,使广告收入暴涨4.1%。

CourseAI
算法论文8

突破Pass@1瓶颈:一种让LLM自我博弈、永不枯竭的RL新范式,超越基线22.8%!

近年来,基于可验证奖励的强化学习(RLVR)在提升大型语言模型(LLM)推理能力上有关键作用,但存在熵崩溃问题。论文提出SVS创新策略,让模型自我合成变分问题形成自我提升循环,实验效果惊人。

深度学习自然语言处理
新闻资讯7

立足影视文化产业,联动科技,超前布局,推动建设北京视听数据可信空间!首创郎园这样为企业服务——

在2025中国广播电视精品创作大会期间,‘中国视听数据资产化主题研讨’活动举办,‘北京视听数据可信空间’启动建设。该空间是全国首个聚焦大视听产业的可信数据空间,为视听产业数据要素市场化配置助力。

郎园Station
开源动态8

完全开源的7B模型,性能比肩主流LLM,训练成本仅16万美元,复现DeepSeek的强化学习!

Moxin-7B由多机构团队联合开发,遵循“开源科学”原则,公开全流程细节。它训练成本仅16万美元,评测表现亮眼,在架构、数据策略、训练过程等方面有创新,为中小企业提供可控AI方案。

AI科技大本营
新闻资讯7

从超级个体到超级团队:AI 如何重塑企业软件生产力?|2026 奇点智能产品大会专题前瞻

2026 奇点智能产品大会 7 月 17 - 18 日在北京举办,设「AI 驱动的软件生产力革命」专题,邀字节跳动、百度等团队实践者,探讨 AI 融入企业全价值链生产闭环,还准备了 AI 产品落地实战资料包。

AI科技大本营
新闻资讯7

国产Agent第一股要来了?但官网都打不开,什么妖魔鬼怪?

国内最大AI数字员工公司冲刺IPO,要做企业Agent第一股,但其官网无法访问。该企业级Agent平台是RPA+AI组合,RPA有致命问题,大模型加入后虽有变化,但事情本身护城河不深,公司靠定制化冲击IPO,且仍亏损。

探索AGI
算法论文8

VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测

近年来,VLA模型成通用机器人控制重要路线,但模型大、动作更新慢的矛盾凸显。华中科技大学联合华为提出TurboVLA,绕开大语言模型,形成V+L→A路径,降低成本,保持操作能力。

机器之心