多领域推理」共找到 6435 篇相关文章

算法论文8

61.3%!「人类最后一场考试」AI终于及格了,揭秘Agent自我进化新路径

上海交通大学等联合团队提出MemRL框架,在不微调模型参数下,让AI在“人类最后一场考试”中准确率跃至61.3%。该框架受人类认知科学启发,解耦推理与记忆,实验表现出色,或为AGI提供高效路径。

AI科技评论
产品应用7

把 AI Coding Agent 搬进终端:Crush 让你的命令行变成“编程搭子”

Crush是Charmbracelet出品的终端AI编程代理,可将工具、代码和工作流接到所选LLM,在终端协同工作。它有模型、会话制等特点,适合终端重度用户等,还介绍了安装、使用及进阶玩法。

小华同学ai
新闻资讯7

arXiv禁用AI,糊涂!18所高校联合发布首个AI科研评审平台

arXiv因AI生成论文泛滥,禁止接收未经同行评审的综述和立场论文。而18所高校联合发布的aiXiv平台,支持AI和人类共创科研成果,采用阶段AI同行评审机制,引发对传统学术体系的反思。

新智元
推荐文章8

AI X 用户研究:能并行千场访谈的“超级研究员”,正重塑产品决策的未来

传统用户体验研究(UXR)面临深度与速度权衡、交付不透明等困境。AI正改写规则,将其变为企业基础设施,在环节带来变革。市场潜力大,新老玩家竞争,未来公司需强化优势、健全合规等。

海外独角兽
新闻资讯8

英伟达斥资50亿美元联手英特尔,将开发AI基础设施和个人计算产品

英伟达斥资50亿美元入股英特尔,双方将联手开发AI基础设施和个人计算领域定制化产品。合作聚焦数据中心和个人计算,是长期战略联盟。公告发布后,英特尔股价涨超26%,AMD股价跌超3%。

AIGC开放社区
产品应用7

Claude Code凭什么牛?大模型团队天天用自家产品,发现bug直接就改了

Claude Code虽有争议,但很成功,4个月用户达11.5万。Claude Code负责人透露构建细节,如产品理念、评估标准、反馈机制等,还阐述编程领域变化、模型与工具共同进化等内容。

机器之心
开源动态7

困在产业落地的数据流通,开源会成为“破局点”吗?

AI时代数据成生产要素,但可信流通困于产业落地。8月14日隐语开源社区三周年升级,扩容为‘隐语·数据可信流通技术社区’,覆盖技术路线。其以开源降低应用门槛,或改写数据产业规则。

InfoQ
开源动态8

Meta刚刚开源DINOv3,横扫60+任务,无标注封神!

今天凌晨,Meta开源视觉大模型DINOv3,采用自我监督学习,无需标注数据。它在60个视觉任务测试中表现出色,超越同类模型。还引入后处理优化策略,扩展应用场景,能适应种部署环境。

AIGC开放社区
开源动态8

当大模型陷入幻觉循环,如何用工程化给它“立规矩”?

普林斯顿和伯克利研究定义“机器胡扯”,指出大模型胡扯问题。蚂蚁集团旗下蚂蚁密算在2025 WAIC提出高阶程序(HOP)框架,为大模型注入规则,还开源此框架,其在行业场景应用效果良好。

InfoQ
推荐文章8

0day漏洞量产?AI Agent“生产线”曝光

本文探讨AI Agent如何通过智能体协作系统打造0day漏洞“生产线”,实现自动化漏洞检测。经测试和实战验证,Agent在复杂代码和大型项目中表现超传统工具,提升了漏洞识别效率与准确性。

腾讯技术工程