AI 大模型」共找到 13957 篇相关文章

推荐文章8

告别“试验田”:当模型真正嵌入 ERP、供应链与核心决策流 | AICon

文章围绕模型嵌入企业核心系统展开,邀用友罗小江等担纲。介绍鞍钢赵伟升级 RAG 技术、用友罗小江构建决策架构、京东耿东阳用模型优化供应链的案例,为企业数智化转型提供参考。

InfoQ
算法论文8

清华上交满分论文证明:强化学习并不能让模型更会思考!

清华和上交在NeurIPS 2025的研究《Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?》获满分。研究聚焦RLVR,发现强化学习不能让模型更会思考,推理能力上限仍由基础模型决定。

AI工程化
新闻资讯8

DeepSeek-R1登顶Nature,8位专家严审通过, 模型「交卷时刻」来了

近日,DeepSeek - R1登上Nature封面,打破主流模型未经过独立同行评审惯例。同行评审可理清模型机制,提升透明度与可信度,还能避免‘刷榜’‘自评’,虽有公司担心泄密,但它是验证成果的必要程序。

新智元
产品应用7

AI全面爆发后,企业正在悄悄争夺知识库入口|甲子光年

AI幻觉问题让企业意识到通用模型在专业场景的局限,需构建企业级知识库。腾讯在峰会上宣布升级知识库产品,乐享知识库通过AI赋能解决数据整合、更新等痛点,未来知识库将与业务深度联动。

甲子光年
新闻资讯7

一个“蠢问题”改写模型规则!Anthropic联创亲曝:瞄准Claude 5开发爆款应用,最强模型的价值会让人忽略成本负担

Anthropic联合创始人Jared Kaplan在YC分享Scaling Law对模型发展的影响及对Claude等模型的意义。他认为AI发展不平衡,建议构建未完全跑通的产品,还介绍了Claude 4优化,探讨人机协作等内容。

InfoQ
推荐文章7

模型狙击黑产:挚文集团社交生态攻防实战全揭秘

挚文集团生态技术负责人李波在AICon会分享模型在社交生态落地实践。介绍集团生态问题,提出构建治理框架,还阐述多模态模型研发方案、细粒度用户画像建设及审核侧应用,最后总结现状并展望未来。

InfoQ
产品应用7

黄仁勋刚讲完AI「五层蛋糕」,他们就跑通了!算力、模型、Agent一次打穿

英伟达CEO黄仁勋提出「AI的五层蛋糕」架构,易鑫结合汽车金融场景构建全栈式AI体系,从基础设施到业务应用层层推进,解决行业痛点,还开源模型推动共赢。

新智元
开源动态8

全流程国产GPU,上下文提速100倍!中国科学院发布「线性复杂度」类脑模型

中国科学院自动化所李国齐、徐波团队发布国产自主可控类脑脉冲模型SpikingBrain-1.0,训练推理全用国产GPU。它具线性复杂度,超长序列处理速度快,还开源7B模型,为类脑智能发展提供新思路。

新智元
算法论文8

模型被确诊「视觉文盲」!多校联合提出MILO,为它植入空间想象力

空间推理是多模态语言模型(MLLMs)应用关键挑战,当前‘语言描述式调优’让模型成‘视觉文盲’。多校联合提出MILO范式,结合视觉生成反馈与语言调优,还构建GeoGen数据集,经五任务验证其有效。

量子位
算法论文7

你永远叫不醒装睡的模型!多轮对话全军覆没,性能暴跌39%

研究人员进行超20万次模拟实验,耗资5000美元,评估模型在多轮对话中的表现。结果显示,模型在多轮对话中性能明显低于单轮对话,平均下降39%,还出现“对话迷失”现象。

新智元