「大模型开发」共找到 10170 篇相关文章

开源动态8

拒绝传统 Router“瞎指挥”,多智能体如何实现智能任务分配?

企业级多智能体系统瓶颈常是负责分发任务的传统 Router 太“傻”,搞不定跨域、解不了冲突、跟不上变化。腾讯云开源 TCAR 智能路由模型,它先推理再选 Agent 集合,经多数据集评测表现出色,还提供完整开源范式。

InfoQ
推荐文章7

AI是「天才」还是「话术大师」?Anthropic颠覆性实验,终揭答案!

Anthropic新研究证实Claude模型有一定内省意识,能控制自身内部状态。用「概念注入」实验,Claude Opus 4和4.1表现最佳。不过该能力不可靠、局限大,未来进化情况待察。

新智元
开源动态7

吴恩达开源的OpenWorker,为什么「不 Work」了?

美国时间7月23日,吴恩达与Rohit Prasad发布开源桌面Agent OpenWorker。它把Agent工作流压缩成桌面应用,但上线一周暴露出多模型兼容、数据流向和权限控制等问题,反映出Agent赛道走向成熟产品的挑战。

AI科技评论
开源动态8

为训推加速!全新FlashQLA注意力算子库开源

自Qwen3-Next发布,GDN成Qwen主力注意力层,随模型规模扩大开销增大。现开源FlashQLA算子库,融合优化GDN Chunked Prefill前反向算子,在NVIDIA Hopper上多场景加速,提升预训练和端侧推理效率。

千问大模型
推荐文章8

昇腾MindSpeed:分布式训练加速库的创新实践与突破

在2025年QCon全球软件开发大会上,华为工程师郑加利分享昇腾MindSpeed分布式训练加速库。它在计算、通信、显存等多维度优化,提升训练效率,还介绍业界加速库及MindSpeed架构,阐述多种优化策略。

InfoQ
开源动态7

专访|两位华人主导创办,Jeff Dean参投,伯克利开源项目SkyPilot转型初创

前沿模型团队算力瓶颈从不足变为分散,开源AI算力调度项目SkyPilot应运而生。7月末,它从高校走出成为初创公司,完成2000万美元种子轮融资。其免费版与商业版各有侧重,切入AI编排赛道潜力大。

DeepTech深科技
算法论文7

Zero-RAG,对冗余知识说“不”

文章指出大语言模型知识冗余,RAG 检索效率低。复旦大学邱锡鹏提出 Zero - RAG,能精准识别并剪除冗余知识,砍 30%语料准确率掉点小,检索延迟降 22%,还介绍了其技术方案。

PaperAgent
算法论文8

想清楚再动手:具身智能也要学会脑补未来和择优执行 | RSS 2025

近年来基础模型在具身智能领域能力惊人,但在真实部署中常‘用不好’。卡耐基梅隆大学与伯克利人工智能研究院团队提出 FOREWARN 框架,结合‘世界模型’与‘多模态语言推理’,解决部署智能难题。

机器之心
开源动态8

15小时3.5万Star!Altman投资的AI终端开源炸圈:曾经没人用,如今靠Agent翻身

AI编程赛道竞争激烈,Altman支持的现代终端Warp宣布开源,OpenAI成创始赞助商。Warp团队认为传统开发模式遇瓶颈,开源可汇集创意,让人类开发者转型为“代理管理者”。此外,Warp在功能上也有开放举措。

AI前线
产品应用8

实测Qwen3.8-Omni-Flash:全模态Agent有了“白菜价”

本文是对千问最新推出的Qwen3.8-Omni-Flash全模态模型的实测,该模型大幅降低全模态Agent使用成本,API价格远低于竞品,开放1M上下文免费测试额度。

量子位