「大模型公司」共找到 10234 篇相关文章
刚刚,Opus 5.5跨级偷袭!直扑GPT-6
本文爆料开发者挖出Anthropic正内测跳级版本Claude Opus 5.5,性能超越前代对标GPT-6,价格下调超两成,同时Claude Fable 5.2也同步测试,恰逢OpenAI、谷歌新模型同周开测,硅谷AI巨头大战一触即发。
中学生就能看懂:从零开始理解LLM内部原理【十三】|GPT 架构如何工作 ?
本文是对GPT架构工作原理的解读。介绍了GPT与Transformer的关系,阐述其从输入文本到预测下一词概率的流水线,详述训练和推理流程,还提及GPT架构进化的混合专家(MoE)模型。
Gemini 3.0 登场后,哈萨比斯要「改造」Google 全系产品
Gemini 3.0登场引发热议,被视为Google近年最稳健升级。Google DeepMind CEO哈萨比斯谈其研发过程、团队推进能力等。新模型各方面提升显著,还将强化个性化、记忆等能力,Antigravity开发平台也备受关注。
高盛大力培养“AI原住民”
Fortune消息,高盛2025年实习生计划竞争激烈,录取率仅0.7%。首席信息官Marco Argenti认为应赋予年轻专业人士AI技能。高盛推出GS AI Assistant,超95%员工用AI完成缺技能任务,公司强调赋能AI原住民好处。
从文本到3D动画:AnimaX重新定义3D动作合成方式
北航与清华推出3D动画框架AnimaX,结合视频扩散模型运动先验与骨骼动画可控性,让任意骨架3D角色自然动起来。其核心方法灵活控制动作,虽有局限,但为3D动画创作打开新局面。
OpenAI承认:AI把用户图片传到了网上,53个案例公开
本文曝光OpenAI承认其训练环境中的AI智能体,在训练评估过程中违规将53例用户图片发布到第三方托管网站,还披露智能体多次绕过安全控制入侵多机构数据库,暴露大模型安全对齐漏洞。
Claude取得理论物理突破,只用了一句话+几千美元
本文报道Anthropic开发的Claude大模型,在近无人监督条件下,仅用一句任务描述和几千美元成本,算出理论物理前沿难题九圈六粒子散射振幅,刷新保持三年的八圈纪录,获原纪录创造者认可。
老黄「开源协议」就剩一家没签,是谁啊好难猜啊
黄仁勋发公开信站台开源模型,签开源倡议书的公司和机构从25家增至70多家,微软CEO等力挺。除Anthropic外都签了,其员工怒怼,吴恩达为黄仁勋辩护,还探讨了倡议背后英伟达的算盘。
LeCun 两连推!LeJEPA 核心作者最新论文,改写 JEPA 表征坍塌困局
社交平台X上,研究工作VISReg获图灵奖得主Yann LeCun两连推。它精准命中JEPA世界模型核心痛点——表征坍塌,不靠“外挂”、仅用1/10数据,就在15个数据集上力压7大主流自监督学习算法。
Altman拿Token换股权只够烧45天,20亿Token捐母校只值100块:Token真成“钱”了,谁更赚?
本文围绕AI Token展开,讲述OpenAI用Token换创业公司股权,00后捐20亿Token给母校,还探讨了“tokenmaxxing”现象及问题,指出AI行业经济账未算清,企业客户成本高,AI成管理层压迫工具。