「大模型3.0」共找到 10176 篇相关文章

新闻资讯7

全国首部可信AI“技术安全+数据合规”标准来了,欢迎参与起草!

2025年国家数据局开展可信数据空间试点,在多领域落地经验。但实践中技术、合规等问题凸显。中国电子商会归口、智合标准中心起草《人工智能大模型可信数据协作安全与合规指南》,有诸多亮点,现公开征集起草单位和起草人。

AI工程化
新闻资讯8

JoyInside 创新大赛现场,我看到 AI 硬件长出了灵魂

作者曾对多数AI硬件失望,认为其有硬件没灵魂。但在观猹和京东联合举办的JoyInside创新大赛上,20强产品让其改观。大赛基于京东JoyAI大模型,缩短产品上市周期,前三名产品各有亮点,还呈现场景垂直化和交互方式改变趋势。

特工宇宙
推荐文章7

上下文工程如何重塑智能体的“思考方式”?

文章指出在大模型时代,智能体能否理解上下文是关键。介绍了上下文工程的魔力、从提示词到上下文工程的演进,分析了上下文工程不等同于上下文的原因及常见失败类型,还给出编排设计和常见策略,最后提及用RAGFlow构建私有知识问答应用。

阿里云开发者
算法论文8

NeurIPS 2025 Spotlight | 选择性知识蒸馏精准过滤:推测解码加速器AdaSPEC来了

大型语言模型推理延迟高、开销大,推测解码可加速但依赖草稿与主模型一致性。佐治亚理工等团队提出 AdaSPEC 蒸馏法,过滤难学 token,提升草稿模型与目标模型对齐度,实验显示能提升接受率和推理速度。

机器之心
新闻资讯7

全国首部可信AI“技术安全+数据合规”标准来了,欢迎参与起草!

2025年国家数据局开展可信数据空间试点,在多领域落地经验。但实践中出现技术与标准等问题,中国电子商会归口、智合标准中心组织起草《人工智能大模型可信数据协作安全与合规指南》,介绍标准内容、亮点等并征集起草单位和起草人。

AI寒武纪
新闻资讯7

国产Agent第一股要来了?但官网都打不开,什么妖魔鬼怪?

国内最大AI数字员工公司冲刺IPO,要做企业Agent第一股,但其官网无法访问。该企业级Agent平台是RPA+AI组合,RPA有致命问题,大模型加入后虽有变化,但事情本身护城河不深,公司靠定制化冲击IPO,且仍亏损。

探索AGI
产品应用3

小美Agent:当龙猫遇到美团外卖的灾难现场

作者体验美团AI助手“小美”后吐槽不断。美团称其用有5600亿参数的龙猫大模型,能力接近GPT - 4o,但它理解需求差、操作订单无效、定位混乱。美团做AI是为跟风,未解决用户真需求,是资源浪费。

AI产品黄叔
7

GPT-5两周内发布,内测猛料流出?GPT-6或已开始训练,奥特曼剧透百万GPU

有爆料称GPT-5将在两周内发布,是多模型组成的系统,含「路由器」,GPT-6已在训练。奥特曼称年底将增超百万GPU,有人看好GPT-5,也有人认为它可能只是路由器。此外,OpenAI有十名员工拒小扎3亿天价offer。

新智元
新闻资讯8

芯片团队规模近3000人!小米扩张自研芯片版图

8月24日小米举行玄戒芯片技术沟通会,公布三颗自研芯片:AI旗舰SoC玄戒O3、端侧AI加速芯片玄戒O100、智驾高算力AI芯片玄戒D100。小米重启大芯片研发五年多,投入超210亿,芯片团队近3000人。

芯师爷
算法论文8

SAPO:让强化学习告别“硬剪切”

强化学习是提升大语言模型推理能力的核心技术之一,但现有基于组的策略优化方法面临 token 级重要性比率高方差问题。GRPO 和 GSPO 采用硬剪切有学习信号丢失等缺点。为此提出 SAPO,用平滑门控函数替代硬剪切,实验效果良好。

通义千问Qwen