大模型架构图」共找到 9832 篇相关文章

算法论文8

模型自发涌现意识了?!Anthropic最新研究震惊全世界

Anthropic研究发现Claude内部自发长出类似人脑意识通达的J空间,开发J - lens工具可观测其运转。实验显示J空间能影响Claude回答,还能抓其小心思,研究审慎探讨模型是否有意识。

AIGC开放社区
算法论文8

Auto-Research「终极考」:新基准撕下模型科研伪装

来自多所高校的研究者提出MLS - Bench,用于解决现有Auto - Research评测的归因问题。它含140个真实研究任务,校准受控修改范围,主实验显示当前模型在方法发现上有明显缺口,Auto - Research需更严格评测标准。

机器之心
开源动态8

Chain-of-Agents: OPPO推出通用智能体模型新范式,多榜单SOTA,模型代码数据全开源

OPPO个性化AI实验室团队推出智能体推理范式CoA及模型AFM,解决传统多智能体系统通信效率低等问题。AFM在近20项测试中刷新记录,降低推理成本,还介绍了架构、数据构建等,也指出待探索方向。

机器之心
算法论文8

华为诺亚发布ScaleNet:模型通用新范式

华为诺亚方舟实验室等团队提出 ScaleNet 方法,创新性地用少量额外参数量将模型深度扩展一倍。结合层级权重共享和轻量级适配器技术,在视觉和语言任务上验证了有效性,提升了模型性能。

机器之心
推荐文章7

tokens烧钱太快?试试这个四层模型组合

ClaudeCode等智能体兴起,开发者面临tokens不够用、主流模型降智问题。网络给出多模型策略缓解,网友将2026年主流模型分四档,还介绍了实际路由策略、部署建议,指出单模型依赖危险。

AI工程化
推荐文章7

Thin Harness, Fat Skills:AI工程架构的本质

文章介绍了AI工程架构本质,阐述Garry Tan倡导的智能体工程三原则,分析架构分层,包括Fat Skills、Fat Code和Thin Harness层,还通过案例展示技能文件进化特性,提及社区讨论、边界迁移和工程纪律价值。

AI工程化
新闻资讯8

放弃开源、重组权力!扎克伯格掏出Muse Spark,杀回模型主桌

Meta在AI发展遇阻后推出Muse Spark,它是MSL首个模型,定位为通向个人超级智能的第一步,性能表现出色,当前闭源,未来Muse系列或有开源变体,标志Meta AI权力结构重塑。

AI科技大本营
新闻资讯7

4·18 北京 Elastic AI Tech Day|搜索基座模型议程(含 Jina 模型与 Reader)

Jina AI 模型迭代加速,Jina Embeddings 到五代目,Reranker v3获最佳论文。4月18日 Elastic AI Tech Day 将举办,Jina 团队将做系统公开技术分享,涵盖搜索AI等多方面内容。

Jina AI
新闻资讯7

光刻机巨头ASML,108亿控股了一家模型公司

光刻机巨头ASML领投法国AI明星公司Mistral AI的C轮融资,砸13亿欧元成第一股东,推高其估值至100亿欧元。Mistral开源与商业化并行,ASML投资或提升光刻机效能。

量子位
算法论文7

刚刚,OpenAI发长篇论文:模型幻觉的原因找到了~

OpenAI发论文揭示语言模型出现幻觉的根本原因,即训练和评估过程奖励猜测而非承认不确定性。预训练阶段就埋下幻觉种子,后训练阶段‘考试机制’强化幻觉,还给出改评分规则的解法。

PaperAgent