「模型架构升级」共找到 9051 篇相关文章

新闻资讯7

清华校友赵晟佳,出任Meta超级智能首席科学家!GPT-4核心功臣,和LeCun平起平坐

Meta宣布清华校友赵晟佳担任超级智能实验室首席科学家。他是ChatGPT、GPT - 4等模型核心贡献者。Meta为组团队不遗余力,还准备超大规模算力,与OpenAI等的AI竞争白热化。

新智元
新闻资讯7

爆火AI编程Windsurf突遭Claude全面断供,开发者大量退订!直接打脸OpenAI

AI编程工具Windsurf突遭Anthropic切断Claude 3.x系列模型API访问权限,CEO称仅获五天通知。用户大量退订,Windsurf官方激烈回应,采取应对措施,AI编程领域大战正酣。

新智元
产品应用7

已经狂揽了15.2k!Cursor 的开源平替 Void 来了!

今天介绍新工具 Void,它是开源的 Cursor 和 GitHub Copilot 替代品,完全免费。拥有强大编程功能,可直连 AI 模型,基于 VS Code 开发,对其用户友好,还介绍了上手、构建等方法。

GitHubStore
新闻资讯8

Claude网页版接入MCP!10款应用一键调用,开发者30分钟可创建新集成

Claude网页版接入MCP,集成10款应用,开发者30分钟可创建新集成。同时Research功能更新,增加更多数据来源,网页搜索功能面向付费用户开放。MCP逐渐成为行业标准,引发对大模型SaaS时代的讨论。

量子位
算法论文8

Agent 护城河:揭秘Harness的三大支柱

上海交大等机构研究者梳理LLM Agent设计逻辑,指出能力正从模型内部流向外部,外部化有记忆、技能、协议三大支柱,Harness负责协调,Agent竞争转向外部化基础设施。

CourseAI
新闻资讯7

刚刚2岁的Llama,「爸妈」都跑了!小扎手拆Meta AI,LeCun保持独立

面对谷歌、OpenAI等劲敌及Llama 4翻车、人才流失困境,小扎决定重组Meta GenAI团队,设三大架构。2023年Llama首版论文14名作者只剩3人,Llama 4也问题不断,而LeCun坚持自己的路线。

新智元
算法论文7

ImageNet分数越高,生成反而越糊?iREPA给出解释

Adobe Research论文指出,视觉模型在ImageNet分类准确率高,生成效果未必好,全局语义强易压扁空间结构。iREPA修改REPA训练流程,削弱全局干扰,提升了生成质量。

新智元
开源动态7

Cloudflare 推出 EmDash,瞄准 WordPress 的下一个十年

Cloudflare 推出 EmDash 预览版开源 CMS,被指是‘WordPress 的精神继任者’。它以无服务器、开发者优先架构重塑 CMS 模型,解决插件安全风险。不过,WordPress 创始人等对此存疑。

InfoQ
推荐文章7

ChatGPT 为什么越来越“懂你”?一文解析它背后的记忆机制

今年4月,OpenAI对ChatGPT记忆系统重磅升级,可参考过往对话提供个性化响应。软件工程师Eric Hayes拆解其双重记忆架构,推测实现机制,探索对用户体验的重塑。

AI科技大本营
推荐文章7

AI Agent的上下文工程:构建Manus的经验教训

上下文工程是AI智能体的“系统一”,决定其速度、恢复力与扩展边界。Manus通过试错与用户验证,给出可复用经验,如利用大模型“上下文学习”能力、关注KV - cache命中率等。

PaperAgent