大模型架构」共找到 9920 篇相关文章

新闻资讯8

奥特曼宣判Transformer死刑! AGI两年内降临,下一代架构已在路上

奥特曼在访谈中表示未来将有全新底层架构取代Transformer,还称AGI两年内降临,编程智能体是下一个引爆点。他回忆OpenAI草创期,还给出诸多判断,“后Transformer”竞赛也已打响。

新智元
产品应用8

刚刚,Cursor 2.0携自研模型Composer强势登场,不再只做「壳」

Cursor 2.0发布重更新,带来自研编码模型Composer和新协作界面。Composer速度领先,针对软件工程优化;新界面以智能体为中心,可并行运行多智能体,还解决了代码评审和测试瓶颈。

机器之心
推荐文章7

盘一下Anthropic 244页Claude Mythos报告中隐藏的SAE技术

Anthropic公布强危险的模型Claude Mythos Preview但未发布。文章深挖其244页报告中SAE技术细节,包括前期探索、技术框架、训练监控、攻击性行为分析及掩盖行为等,助了解模型内部思维。

PaperAgent
产品应用7

融云首发“通信+AI”闭环架构,让 AI 有情商、能落地|甲子光年

8月28日融云在AIM线上发布会推出“通信+AI”产品矩阵,围绕“能落地的好AI”理念打造高情商AI。通信与AI相互增强,构建四层知识体系数字分身,其产品可解决多场景痛点,还能降低开发门槛。

甲子光年
开源动态8

Agent记忆赛道洗牌!LoCoMo-Refined重磅发布,主流记忆框架迎来核心检验

南京学与上海人工智能实验室联合推出 LoCoMo-Refined,这是严苛的 Agent 记忆评测基准。它指出当前记忆评测基准有两漏洞,在其标准下主流记忆框架得分普降,且相关数据集和评测脚本已开源。

AI科技评论
新闻资讯8

在ICLR 2026主会之前,我们和30多位入选者聊了聊最前沿的AI细节

4月14日,智源社区、DeepTech联合举办ICLR 2026预讲会。会议聚焦顶会核心精华,三十余位论文作者分享AI Agent、语言模型等热门领域成果,展示解决模型痛点的研究。

DeepTech深科技
新闻资讯7

Sam Altman:美国严重低估中国AI实力,OpenAI开源因为DeepSeek

OpenAI联合创始人Sam Altman警告美国可能低估中国AI进展,出口管制难限中国发展。他称中国在多层面有进展,美国政策难跟上技术现实。此外,中国开源模型如DeepSeek促使OpenAI发布开放权重模型

AIGC开放社区
算法论文8

Arc研究所造出能“举一反三”的虚拟细胞模型,破解跨细胞预测难题

生物学和药物研发中,因细胞组合庞,难以全实验验证,且同药在不同细胞效果不同。Arc Institute 团队推出虚拟细胞模型 STATE 及评测套件 Cell - Eval,STATE 预测效果优,但也存在短板。

DeepTech深科技
开源动态8

世界模型有了开源基座Emu3.5!拿下多模态SOTA,性能超越Nano Banana

北京智源人工智能研究院的悟界·Emu3.5是最新最强的开源原生多模态世界模型,能处理图、文、视频任务,在多项权威基准上性能亮眼,还具备理解长时序等能力,背后有技术创新,且选择开源。

量子位
新闻资讯7

Elad Gil:AI 应用进入收敛期,比模型跑得快才能抓住红利

硅谷AI投资人Elad Gil回顾AI领域投资,指出AI应用进入收敛期。基础模型头部梯队明显,格局难改;GPT-ladder带来新机会;应用端理解痛点、构建工作流的团队更有优势,AI Agent重塑商业模式。

Founder Park