编程基准测试」共找到 2963 篇相关文章

算法论文8

OpenVision 2:大道至简的生成式预训练视觉编码器

多模态大模型浪潮中,视觉模块是关键。此前OpenVision训练管线复杂,成本高。研究者提出OpenVision 2,移除文本编码器与对比学习,引入随机丢弃视觉token技巧,性能佳且效率高,挑战了对比学习范式。

机器之心
新闻资讯8

吴恩达:不理解计算机的工作原理,你不可能单靠 Vibe Coding 就走向卓越,基础知识依然至关重要

吴恩达指出懂AI的开发者供不应求,但计算机专业应届生失业率上升,因大学课程未跟上时代。他面试看重借助AI助手开发、运用AI基础模块构建应用等能力,强调基础知识仍重要。

宝玉AI
算法论文8

科研智能体「漫游指南」—助你构建领域专属科研智能体

该综述提供科研智能体构建指南,提出三级分级系统,阐述构建流程与能力增强方法,涵盖知识组织、注入、工具集成,还提及基准评估和未来研究方向,促进AI与自然科学融合。

机器之心
产品应用7

动动嘴,AI自己打开小红书、高德地图帮你干活了,国产Agent深度体验

作者为测试AutoGLM能否提高AHPU,用两个实测案例展示其功能,还拆解产品技术,介绍其进化历程。AutoGLM虽有不足,但已接近作者期待的产品形态,未来有望持续进化。

AI产品黄叔
推荐文章8

入职OpenAI啦!这是我的AI Research面试指南

作者分享入职OpenAI的面试经历、经验与建议。涵盖身心调适、通用建议、各环节应对技巧等,如提前准备、与朋友模拟、注意设备和细节等,助读者应对AI Research面试。

深度学习自然语言处理
开源动态8

狂揽6.9K star!!微软又来一款王炸项目,实时跟踪、透明可控,牛皮!

微软开源项目Magentic-UI狂揽6.9K star。它是“以人为本”网页智能助手,基于AutoGen框架,可让用户全程掌控,能实时跟踪、透明可控,有协同规划等功能,适合测试、分析等人员。

开源先锋
算法论文8

自我进化Agent综述:通往超级智能的进化之路

当前大型语言模型面对新知识、动态环境时存在固定参数瓶颈,自进化智能体研究应运而生。本论文作为该领域首部系统性综述,提出革命性框架,解析自进化智能体技术脉络与未来挑战。

深度学习自然语言处理
开源动态8

字节跳动刚把自己招牌AI Agent开源了,可商用、超6000颗星

字节跳动招牌AI Agent扣子(Coze)开源且支持商用。它是开发平台,提供大模型、工具与开发模式,可视化一站式开发,有上百种模版,还介绍了无代码开发客服智能体的步骤及功能。

AIGC开放社区
算法论文8

五倍推理加速,激发自回归潜能,苹果新工作让LLM预测未来

近年来自回归训练方法成语言模型主流范式,但推理阶段计算开销大。苹果研究人员开发框架,让预训练自回归大模型多 token 预测,代码和数学任务推理加速达 5.35 倍,一般任务约 2.5 倍。

机器之心
新闻资讯7

GPT-5被意外泄露,奥特曼宣布即将发布!

一则GPT - 5被意外泄露的消息引发关注,SecureBio的github配置文件中出现相关内容,暗示要把‘推理’提升到新高度。OpenAI CEO等暗示GPT - 5即将发布,但不打算短期内推出有IMO金牌级别数学能力的正式产品。

PaperAgent