核心认知能力」共找到 4751 篇相关文章

算法论文8

浙大&港理工等提出InfiGUI-R1:利用强化学习,让GUI智能体学会规划任务、反思错误

多模态大模型驱动的GUI智能体有潜力,但现有智能体面对复杂任务力不从心。浙大等机构提出InfiGUI-R1及Actor2Reasoner框架,通过两阶段训练提升智能体能力,InfiGUI-R1-3B在多基准测试中性能卓越,为GUI自动化工具开辟新道路。

机器之心
产品应用8

云知声发布U2-Flash,要争“大模型主力位”|甲子光年

本文报道云知声发布U2-Flash大模型,基于原有U2基座,通过创新后训练方案提升Coding、Agent等复杂任务能力,多项评测比肩头部模型,目标成为企业真实生产任务的主力大模型。

甲子光年
推荐文章8

人类造的最后一个AI!上交清华字节等发布递归自进化路线图

本文解读了上海交大、清华、字节跳动等机构联合发布的递归自我改进AI综述,提出五级AI自主改进框架,分析RSI发展现状、应用场景与核心挑战,指出RSI有望突破AI研发的人力成本瓶颈。

AI寒武纪
新闻资讯8

「人类造的最后一个AI」还有多远?一张图看懂OpenAI、Anthropic等大厂的RSI进度

本文报道中国前沿AI机构Theseus Labs联合多家产学研机构发布RSI领域研究报告,梳理全球72家头部AI厂商的RSI研发进展,提出五级RSI框架与HCI指标,拆解出可工程化的RSI发展路径,发布后在海外AI圈引发热议。

机器之心
新闻资讯8

OpenAI杀疯了!五天内再破千禧年数学难题,霍奇猜想也要被攻破了?

本文爆料头部AI实验室破解千禧年数学难题的最新进展,OpenAI攻克纳维-斯托克斯问题后,五天内就在霍奇猜想上取得实质性进展,Anthropic也接近解决另一难题,展现AI推理能力的飞速迭代。

AI寒武纪
新闻资讯8

首批GPT-6内测结果好离谱啊。。。

GPT - 6使用资格分批开放,内测玩家抢先体验。其在3D生成、游戏开发、网页制作等多领域表现出色,如15分钟做出Mac应用,空间推理达世界级水平,但运行时Token消耗大。

量子位
新闻资讯8

金融AI的年度大考交卷了:2万名选手、30+家机构、百亿级数据开源

八月末上海举办的AFAC金融智能创新大赛(AFAC2026)总决赛,吸引众多顶尖选手。赛题模拟真实金融场景,涵盖数据规模、反馈少等难题。四届赛题反映金融AI技术迁徙,还开源百万金融智能数据集,构建数据飞轮。

量子位
新闻资讯8

刚刚,奥特曼炮轰达里奥「反人类」!绝密模型同日曝光

OpenAI员工「手滑」暴露模型代号gpt - nathree,引发GPT - 6 Astra将至的猜测。Anthropic也有新模型曝光。同时,奥特曼在播客中认错、怒批行业营销话术,还分享了OpenAI的创业历程。

新智元
产品应用8

基于阿里云 AgentLoop 的 DeepSeek Harness 评测实践

本文分享基于阿里云 AgentLoop 平台的 DeepSeek Harness 评测实践。介绍了 DeepSeek Harness 工程架构,阐述 AgentLoop 平台接入方式及价值,还详述评估器设计思路、展示评测结果,最后总结方法论并展望后续工作。

阿里云开发者
产品应用7

AI视频运镜玄学已破!告别无限抽卡,3D预演台直接封神

用AI做视频常遇运镜、人物走位等问题,因文生视频系统缺空间锚定能力。updream在8月17日上线「预演台」功能,通过传参考图自动生成3D白模场景,实测显示其显著减少「抽卡」次数。

新智元