模型问题」共找到 9467 篇相关文章

新闻资讯7

前Meta大神创业,用强化学习打造PokeeResearch-7B模型,刷新AI深度研究SOTA

Pokee AI发论文介绍70亿参数的PokeeResearch - 7B模型,用基于AI反馈的强化学习和推理框架,在深度研究基准测试中成绩领先。该公司由前Meta大神创立,产品可打通多应用,已获融资并公开测试。

AIGC开放社区
算法论文8

【梁文锋署名】DeepSeek再发新论文:75%思考+25%记忆,这是他们算出来的最优解

DeepSeek新论文《Conditional Memory via Scalable Lookup》提出Engram模块,指出大模型用计算模拟查字典是浪费算力,Engram能给模型装“记忆”,还发现参数分配呈U型缩放定律,推理和长上下文能力提升显著。

花叔
推荐文章7

反常识!GPT-5和Opus 4同时翻车:AI越强,越不爱用工具?

作者用GPT - 5和Claude Opus 4做进化实验,让其开发工具。两模型表现出色,但面对实际任务却不用自制工具。原因包括模型规模使脚手架工作无价值、RLHF带来工具厌恶、逼近AGI渐近线等。

探索AGI
新闻资讯8

AI也能当情感大师?腾讯发布最新AI社交智能榜单,最新版GPT-4o拿下第一

腾讯混元AI数字人团队打造SAGE自动化评估框架,可评价AI“共情力”与能否成“知心伴侣”。研究团队用其对18个主流模型测评,GPT - 4o表现最佳,还通过多实验分析模型特性。

量子位
新闻资讯8

陶哲轩,用AI爆改科研范式

菲尔兹奖得主陶哲轩让ChatGPT把数学论文翻译成Lean代码,与AI合作完成埃尔德什第613号问题反例的形式化证明。人机配合虽有波折,但AI节省了时间。此外,两位数学家也用AI验证第707号问题反例,数学证明正进入‘AI辅助时代’。

新智元
推荐文章7

评论送书 | 一文读懂多Agent系统演进趋势

文章指出多Agent系统成大模型应用重要方向。分析大模型交互的上下文瓶颈,如语义膨胀、信息密度不均等;阐述Agent间协同结构演化,包括松耦合编排、语义协同等;还说明传统Prompt工程局限及通信与上下文协议的作用。

AIGC开放社区
新闻资讯7

黄仁勋人生首条推文力挺开源,“Kimi恐慌”成为风暴眼

当地时间7月24日,英伟达创始人黄仁勋发首条推特分享联名信力挺开放权重AI。此事与新开源模型Kimi K3引发的‘Kimi恐慌’相关,‘开源vs闭源’路线之争因此推向高潮。同时,围绕模型蒸馏是否侵权争议不断。

DeepTech深科技
开源动态8

社区供稿丨Ring-2.5-1T,思更深,行更远

今天发布并开源万亿参数思考模型 Ring-2.5-1T,在生成效率、思考深度、长程执行上大幅提升。与其他模型对比,在高难推理和长程任务执行达开源领先。介绍架构优势、手搓案例,也提及不足与未来计划。

Hugging Face
新闻资讯7

反代终结!Google收紧Gemini免费午餐:Pro模型仅限付费,滥用账号将遭封禁

Google开发者体验高级产品总监宣布Gemini CLI服务三项政策调整,3月25日生效。免费用户失Pro模型访问权,加强滥用检测,违规将封禁。付费门槛明确,此次针对‘薅羊毛’现象。

AI工程化
推荐文章8

三点十四分的狗

文章指出AI记忆面临诸多困境,如记不住、记太多,还有记忆审计和沉淀判断力等问题。作者认为遗忘是记忆系统的重要功能,AI应学会主动遗忘,谁先解决此问题,谁就能做出真正懂人的AI。

花叔