「中国开源模型」共找到 9503 篇相关文章
突发!卡帕西官宣加入Anthropic,OpenAI对家挤满了前员工
安德烈·卡帕西宣布加入 Anthropic,负责 Claude 模型大规模训练。他是知名 AI 研究者,曾任职 OpenAI、特斯拉等。此前 AI 人才争夺 Meta 和 OpenAI 是主角,Anthropic 闷声吸纳了卡帕西,OpenAI 联合创始团队成员多有流失。
GPT-5系列咋都爱说「哥布林」?原因找到了
OpenAI发布博客解释模型迷上「哥布林」的原因。原来是训练“Nerdy”人格时,奖励信号偏爱怪物词汇,强化学习将风格固化并扩散到普通对话。此前DeepSeek V3.1也出现过「极」字Bug。
成立半年连续获数千万融资,智子芯元凭什么卡位国产算力生态?|甲子光年
智子芯元成立半年获数千万天使轮融资。国产AI算力生态面临适配难题,该公司用“AI+运筹”解决。其核心技术“运筹学x大模型”,自研KernelCAT引擎,实现多场景高效交付,具泛化性。
谷歌新架构突破Transformer超长上下文瓶颈!Hinton灵魂拷问:后悔Open吗?
谷歌在NeurIPS 2025发布两项大模型新架构研究,通过‘测试时训练’机制,推理阶段可将上下文窗口扩展至200万token。新成果Titans和MIRAS结合RNN速度与Transformer性能,突破超长上下文瓶颈。
3D高斯泼溅,可输入视图量高达500!推理速度提升3倍,内存少80%
ZPressor能高效压缩3D高斯泼溅(3DGS)模型的多视图输入,解决其在处理密集视图时的性能瓶颈。它基于信息瓶颈原理,分三步压缩信息,降低内存占用和推理时间,提升3DGS在高视图输入下的性能。
The Btch:838 | 苹果加强生成式 AI 布局
苹果更新 Apple Foundation Models(AFM)系列,含设备端和服务器端版本,还发布 Foundation Models 框架。AFM 模型架构特别,训练有优化,测试表现有差异。此前苹果论文引争议,此次或是其重启 AI 战略之举。
「神经软件」正在到来,人类代码将失去意义!
Lambda Labs CEO Stephen Balaban 在英伟达 GTC 2025 提出神经软件概念,指不再写代码,让大语言模型成软件。它没传统软件的 bug 问题,未来计算机或端到端神经化,虽有争议,但变革在加速。
首个企业级智能体全开源!京东云将Agent门槛直接给打没了
京东云JoyAgent成为首个100%开源企业级智能体,完整能力全部开源,企业开发者可本地独立部署。它多智能体协同能力强、性能一流,还具多项技术创新,解决了企业AI落地难题。
狂涨 9.5K star!!又一款轻量好用的web自动化项目,太爽了!!
介绍开源项目Nanobrowser,它是基于Chrome扩展的AI网页自动化工具,通过多智能体协作系统理解自然语言指令完成复杂网页任务,开源免费、保障隐私,有诸多实用功能,已获9.5K star。
突发!Opus 5.1被曝本周发布,最强AI智能体恐大洗牌
消息称Anthropic本周将发布Opus 5.1,其升级聚焦单Token智能水平,强化编程、推理、AI Agent能力;OpenAI 10万亿参数模型Bel完成预训练;企业选模型‘够用就好’,Anthropic Fable 5份额低。