「大模型公司」共找到 10186 篇相关文章
DeepSeek-R2可能本月发布,使用华为AI芯片
Huaweicentral消息,搭载华为昇腾AI芯片的DeepSeek - R2可能8月15 - 30日发布,或媲美GPT - 5。它运行在昇腾910B芯片集群,参数规模达1.2万亿,将以低价提供API,冲击开源大模型市场。
训练数据枯竭怎么办?首篇「数据价值密度」综述理清思路
上海交通大学与上海人工智能实验室团队发布首篇「数据价值密度」综述。提出“数据价值密度”概念并定义,建立分类框架梳理现有工作,还指出该领域面临的挑战,为大模型训练提供指南。
Nature新研究:AI竟然分不清事实和信念
斯坦福大学团队在Nature发表研究,测试15个大模型,发现其区分事实、信念和知识存在严重缺陷。如处理第一人称信念准确率低,对语言线索依赖高,在高风险领域应用令人担忧。
DeepResearch的概念、核心挑战与进化路径
华为、利物浦大学等研究者撰写综述文章《DEEP RESEARCH AGENTS》,梳理了DeepResearch进展。它由大语言模型驱动,超越RAG等现有技术,介绍其核心技术组件,指出面临的挑战并指明未来发展方向。
Claude惨遭停用, GPT-4.1接任! 绝密备忘录爆出, 怒撕「硅谷甄嬛」奥特曼
一份绝密备忘录爆出,Dario Amodei 怒喷 OpenAI 与五角大楼的交易是「安全作秀」。美国国务院等抛弃 Claude,接入 GPT - 4.1,多家国防科技公司停用 Claude,Anthropic 与大厂合作或被切割。
GPT-5数字母依然翻车!马库斯:泛化问题仍未解决,Scaling无法实现AGI
杜克大学教授让GPT - 5数blueberry里的b,结果GPT - 5多次答错。著名学者马库斯整理其各种bug,指出大模型泛化问题严重,认为Scaling无法实现AGI,转向神经符号AI才是途径。
让思考更准更长!强化学习新算法FIPO来了
阿里通义实验室Qwen Pilot团队发布系列博客剖析大模型强化学习机制与局限,推出新算法FIPO。该算法引入Future - KL机制,解决‘推理长度停滞’问题,在多项测试表现优异,还介绍招聘信息。
Sam Altman:超级智能近在眼前!OpenAI官方13页蓝图引爆海外社区
OpenAI CEO Sam Altman 在 Axios 采访中称超级人工智能到来比预期快,社会需新契约管理。OpenAI 提出‘智能时代的产业政策’,含设公共财富基金、征机器人税等提案,还谈到下一代大模型。
被误解的谷歌和百度。
文章指出大模型竞争短期拼产品体验,长期靠系统化落地能力。谷歌和百度虽被误解,但前者在I/O大会展示AI布局,后者营收利润双增,两家都构建生态,在AI下半场迎头赶上。
比NanoBanana更擅长中文和细节控制!兔展&北大Uniworld V2刷新SOTA
兔展智能与北京大学的UniWorld团队推出图像编辑模型UniWorld - V2,它提出UniWorld - R1框架,在权威测试中超越顶尖闭源模型。该框架通用性强,能提升其他基础模型性能,相关论文、代码和模型已开源。