B端业务」共找到 1730 篇相关文章

算法论文7

低延迟、高吞吐,LLM优化与高效推理引擎综述

LLM计算成本高,用户要低延迟,企业要高吞吐。工程师开发优化技术,如动态批处理、KV缓存、模型量化。论文对比25款推理引擎,还探讨了多模态支持、手机推理、新型架构支持等进化方向。

深度学习自然语言处理
新闻资讯7

忘掉大模型,微软实证:小模型才是Agentic AI的未来!

过去两年大模型在数学竞赛题上靠Test - Time Scaling发展遇天花板。微软rStar2 - Agent让14B小模型学会‘写代码→跑结果→改思路’,表现出色。还介绍了其基础设施、算法、训练配方等方法。

PaperAgent
新闻资讯7

吴恩达来信:为什么 Meta 会向 AI 工程师支付 1 亿美元薪酬

近期,Meta 因向 AI 模型开发人员提供超 1 亿美元巨额薪酬登上头条。模型扩展资本密集,薪酬占比小,且 AI 对 Meta 业务机遇与威胁并存,招聘还能获技术洞察,所以高薪合理。

DeeplearningAI
新闻资讯8

没受DeepSeek影响,英伟达最新财报创历史记录,同比增长260%

今天凌晨英伟达发布2025财年第一季度财报,收入达260.44亿美元,同比增262%,净利润飙升628%。多业务出色,还推出新硬件、技术和软件服务。二季度业绩展望佳,有望延续增长。

AIGC开放社区
新闻资讯7

超10亿人民币!芯擎科技完成新一轮融资,获得两省首单AIC

近期,芯擎科技宣布完成超10亿元B轮融资,获湖北、山东两省首单AIC股权项目。它是国产智能座舱芯片市占率第一,能覆盖智能座舱到智能驾驶。创始人称将加大研发,推动汽车智能化。

芯师爷
算法论文8

RL训练总崩溃?R1-Reward稳定解锁奖励模型Long-Cot推理能力

多模态奖励模型对提升多模态大语言模型表现至关重要,但强化学习在奖励建模应用有挑战。快手等团队提出R1 - Reward,解决训练不稳定等问题,在基准上超SOTA模型,还在快手业务场景成功应用。

机器之心
开源动态8

“AI大神”李沐终于开源新模型,爆肝6个月,上线迅速斩获3.6k stars!

7月23日,“AI大神”李沐开源音频基础模型Higgs Audio v2,构建于Llama - 3.2 - 3B之上,预训练数据丰富。该模型在多个测评中成绩领先,有多种能力,李沐介绍其技术及训练方法。

AI前线
开源动态7

数学编码超越O3-high,英伟达版「DeepSeek R1二代」推理模型开源~

Nvidia开源OpenReasoning-Nemotron系列模型合集,采用Qwen2.5架构,基于500万条轨迹训练。评测输出长度最高64K token,多版本刷新SOTA。其‘heavy’模式有独特能力,32B版在数学与编程基准超越O3(High)。

PaperAgent
开源动态8

开源 AI 视频平台

开源 AI 视频平台集成剪辑生成器、AI 短视频、YouTube 工作室三大工具,能将长视频转短视频,为业务生成营销视频,还具备免费 YouTube 工具包。支持多平台发布,自托管永久免费。

GitHubStore
新闻资讯7

成立仅6个月的AI公司,卖了8000万美元

著名SaaS平台Wix以8000万美元收购AI开发平台Base44。Base44核心产品是AI编程平台,能依自然语言提示生成全栈应用程序。收购后,Wix业务版图拓展,向对话式AI平台转型。

AIGC开放社区