「研究智能体」共找到 5016 篇相关文章
DeepSeek又拿第一!首创「因果流」视觉推理,超越Gemini
DeepSeek开源DeepSeek - OCR2,引入DeepEncoder V2视觉编码器,打破传统模型扫描限制,模仿人类视觉「因果流」逻辑。它解决了传统VLM忽略图像语义结构问题,在多项测试中表现出色,还验证了「LLM作为视觉编码器」可行性。
再见了, OpenAI!三年老用户忍痛卸载ChatGPT
从ChatGPT惊艳问世到如今广告缠身,OpenAI乌托邦梦碎!谷歌和Anthropic强势反扑,达沃斯论坛上互怼升级。OpenAI在AI大战中似已落后,还面临马斯克诉讼、巨额算力承诺等问题。不过投资人认为4家AI巨头终将平安落地。
10B超越Gemini-2.5-Pro!阶跃星辰端侧多模态天花板开源
阶跃星辰多模态智能团队开源STEP3-VL-10B多模态模型,仅100亿参数却性能惊人。它采用了独特的架构、训练策略与推理机制,在多任务上表现出色,为小模型发展提供新思路。
梁文锋署名!DeepSeek再发炸裂论文:提出“条件记忆”新范式,彻底打破GPU推理显存墙
来自DeepSeek的新论文提出“条件记忆(Conditional Memory)”新范式,推出Engram模块,实现可扩展知识查找。研究揭示U形缩放定律,构建的Engram模型性能超越纯MoE基线,还打破了GPU显存瓶颈。
阿里巴巴新论文:让LLM学会管理记忆,告别人工规则
大型语言模型处理长对话或复杂任务时,记忆管理靠人工规则,效果有限。阿里巴巴团队新论文提出把记忆管理变为可学习的强化学习策略,AgeMem框架统一长短期记忆管理,经三阶段训练,效果显著。
那个固执的法国老头走了,带走了硅谷最后的理想主义
2026年1月,65岁的Yann LeCun离职Meta创业后炮轰老东家。他曾被扎克伯格“三顾茅庐”加入Facebook,创建FAIR。他推动了PyTorch发展,坚持智能应基于世界模型,与主流LLM路线分歧,最终因理念不合离开。
谷歌创始人布林:当年发完Transformer论文,我们太不当回事了
在斯坦福大学工程学院百年庆典活动上,谷歌联合创始人谢尔盖・布林与校长、工程学院院长对谈。他回顾谷歌发展,称曾对Transformer论文未足够重视,还分享对专业选择、大学模式、学术与产业等方面的看法。
谷歌突砍Gemini免费版炸锅,数据养模遭背刺?GPT-5.2突袭Gemini 3,Demis Hassabis:谷歌须占最强位
近日谷歌收紧Gemini API免费层级限制,引发开发者不满。同时,OpenAI计划提前发布GPT - 5.2竞争。谷歌DeepMind的Hassabis表示要与OpenAI竞争到底,对Gemini 3满意,还介绍了谷歌未来三个主打方向。
Human In the Loop竟然可以是个MCP?
文章基于阿里实践,阐述如何在大模型研发平台OpenLM及其他Agent平台,针对“Human In The Loop”场景做产品设计与研发。介绍用MCP实现人机回路的方案,还探讨人类回答及提示词倾向性等问题。
英伟达巧用8B模型秒掉GPT-5,开源了
英伟达携手港大开源Orchestrator-8B小模型,在HLE测试中分数超GPT - 5,成本低且速度快。它靠ToolOrchestra训练法,协调工具解题。此赛道已有多项研究,小模型实用优势明显。