行业应用」共找到 3038 篇相关文章

产品应用8

面壁MiniCPM4端侧模型发布:长文本推理 5 倍提速,0.5B 模型拿下新SOTA

2025智源大会,面壁发布MiniCPM4.0端侧模型,含8B稀疏闪电版与0.5B款。其采用InfLLM架构,实现长文本推理5倍提速、最高220倍加速,还在性能、部署等方面优化,适配多芯片与框架。

AI科技大本营
新闻资讯8

SGLang 推理引擎的技术要点与部署实践|AICon 北京站前瞻

SGLang 是开源推理引擎,截至 2025 年 6 月,GitHub 近 15K Stars,月均下载量超 10 万次,被多个行业巨头采纳。InfoQ 专访其核心开发者尹良升,他分享关键技术等内容,6 月 27 - 28 日他将在 AICon 演讲。

InfoQ
新闻资讯7

性能翻番背后:讯飞与昇腾,如何用国产算力炼就大模型?|甲子光年

在全球AI竞争激烈背景下,科大讯飞与华为昇腾深度合作意义重大。双方合作历经四阶段,实现性能提升与技术突破,还通过软硬件协同构建AI自主发展竞争力,加速大模型行业落地。

甲子光年
新闻资讯8

AI青年学霸齐聚杭州!这场峰会要选出「未来科学新星」

2025年6月6 - 8日,2025全球人工智能技术大会(GAITC 2025)将在杭州召开,多位院士带来重磅演讲。6月7日下午,首届“清源学者”前沿交叉峰会开幕,15位青年学者将分享原创成果,展示人工智能应用潜力。

量子位
算法论文8

1/15成本,实现AI水印新SOTA | 南洋理工大学&A*STAR

给AI生成作品打水印成行业共识,但传统方法有短板。南洋理工大学等机构研究人员提出局部鲁棒图像水印方法MaskMark,成本仅为Meta模型WAM的1/15,在多任务中表现优异。

量子位
算法论文8

谷歌之后,英伟达入局扩散大语言模型,Fast-dLLM推理速度狂飙27.6倍

大语言模型领域,推理效率制约实际应用。谷歌Gemini diffusion曾展扩散模型并行潜力,但开源扩散LLM推理慢。近日,NVIDIA等推出Fast - dLLM,无需训练即插即用,推理速度狂飙27.6倍,兼顾速度与精度。

机器之心
推荐文章7

Dify、n8n、Coze、Fastgpt、Ragflow到底该怎么选?超详细指南~

文章对比了Dify、Coze、n8n、FastGPT和RAGFlow五个主流平台,从功能、使用体验、应用场景等方面详细分析其特点,给出选择建议,还提醒考虑预算、技术能力等要素,帮读者选合适平台。

开源星探
推荐文章8

AI 不会杀死初级开发者——但你的招聘策略可能会

文章指出在 AI 编码普及的行业,初级开发者角色转变但不可或缺。AI 虽自动化部分任务,却带来新挑战与期望。初级需培养新技能,避免过度依赖,公司也应调整招聘、培养和评估方式。

宝玉AI
新闻资讯7

业界对 Agent 的最大误解:它能解决所有问题

业界认为 AI Agent 规模应用“拐点时刻”已至,但 IBM 强调不必过度“神化”AI。其推出 watsonx Orchestrate 解决方案,还指出企业落地 AI 要考虑数据、流程自动化等问题,强调回归业务本质看技术价值。

AI前线
新闻资讯8

万字实录:VLA 范式,具身智能的曙光与迷雾丨GAIR Live

2025年5月9日,雷峰网等举办“具身智能之VLA的实践与突破”线上圆桌沙龙。多位专家探讨VLA定义、起源、技术路线等,指出其面临推理、数据等瓶颈,还讨论了与强化学习结合、数据选择、提升泛化性、长程任务及落地场景等问题。

AI科技评论