多上下文模式匹配」共找到 1622 篇相关文章

新闻资讯7

网民票选AI王者,LMArena一夜变17亿美元独角兽!

LMArena原是校园开源小项目,从2023年起步,如今估值达17亿美元。其Arena模式让网友盲投选AI,Elo评分系统算排名。虽有众包投票易操纵等争议,但已成行业标杆,还将为大厂提供付费评估服务。

新智元
产品应用8

救命!和漫画角色聊上头了,AI陪伴的新答案有了

快看漫画2.0版本推出AI陪伴互动漫画,将AI嵌入漫画角色,玩家以第一视角改写故事。它解决了AI陪伴产品痛点,靠共同经历和叙事上下文存续关系,还集成多家AI技术,内测数据显示有商业潜力。

量子位
开源动态8

8B模型任务击败GPT-5?阶跃星辰开源Deep Think新框架,小模型解锁百万Token测试时计算

阶跃星辰推出并行协同推理框架PaCoRe,让大模型突破上下文窗口和处理速度限制。基于此框架,小模型能解锁百万级Token测试时计算。PaCoRe - 8B在数学基准测试中超越GPT - 5,还具备前沿性能、“综合”能力涌现等优势。

机器之心
开源动态8

让LLM不再话痨,快手HiPO框架来了

当前LLM存在‘过度思考’困境,效率与成本矛盾突出。快手与南大合作推出HiPO框架,通过混合数据冷启动和混合强化学习奖励系统,让模型能自主决策思考模式,实验显示它提升了效率和准确率,还具强泛化性。

机器之心
产品应用8

扔掉人工公式:快手EMER框架,用“会比较、自进化”的模型重构短视频推荐排序

过去十年,推荐排序多依赖人工设计公式,但此模式遇瓶颈。快手策略算法团队提出 EMER 框架,用“会比较、能进化的 AI 模型”重构短视频推荐排序,在快手主 App 和极速版效果显著,还为行业提供解决方案。

机器之心
新闻资讯8

刚刚,英伟达祭出下一代GPU!狂飙百万token巨兽,投1亿爆赚50亿

昨天,英伟达发布专为海量上下文AI打造的CUDA GPU——Rubin CPX,将大模型推理带入「百万Token时代」。它性能强大,能带来高回报,可重写推理经济,还将得到英伟达全栈AI生态支持,预计2026年底可用。

新智元
新闻资讯8

谷歌AI获IMO“唯一金牌”,硅谷夹道祝贺,奥特曼丢人又丢人

谷歌Gemini新模型获IMO官方认证金牌,用时4.5小时答对5道题,成绩获主席肯定。该进阶版搭载新思考模式,后续开放给订阅用户。这与OpenAI参赛情况形成鲜明对比,OpenAI遭质疑,研究员回应未获网友完全认可。

量子位
开源动态8

小红书hi lab首次开源文本大模型,训练资源不到Qwen2.5 72B 的四分之一

6月6日,小红书hi lab团队首次开源文本大模型dots.llm1,采用MIT许可证。该模型激活参数量140亿,总参数量1420亿,上下文长度32K。训练资源不到Qwen2.5 72B的四分之一,在多个测评中表现出色。

AI前线
新闻资讯8

谷歌发布最强 AI“全家桶”、一句话就让AI拍大片!这一夜,谷歌Gemini贯穿始终,网友:果然Android“靠边站”了

谷歌在I/O大会推出AI“全家桶”,含Gemini 2.5模型更新、搜索新AI模式等。谷歌已发布十多个新模型、20多个重大AI产品与功能,多项数据显示AI发展迅速,还有多项目融入产品,多模态模型升级。

AI科技大本营
开源动态8

DeepSeek Harness背后的“心脏”:Cordis 到底是什么

文章介绍Cordis框架,它原服务第三方QQ机器人,现是DeepSeek Harness心脏。阐述其设计初衷、核心机制,如插件、上下文等概念,还提及在DSH中的应用,展示了插件槽位和生态,最后介绍相关论文和该框架的生态情况。

腾讯技术工程