人类在环」共找到 8658 篇相关文章

开源动态8

刷新复杂Agent推理记录!阿里通义开源网络智能体超越DeepSeek R1,Grok-3

互联网信息检索中,复杂问题让普通开源模型力不从心。阿里通义实验室提出WebSailor方案,通过SailorFog - QA数据集和DUPO算法等创新,提升模型能力,多基准测试中超越诸多开闭源模型。

量子位
产品应用8

刚刚,阿里Qwen3.8-Max来了!冲进全球第一梯队,模型表现直逼Claude

阿里巴巴突袭发布新一代基座大模型Qwen3.8 - Max,它总参数量达2.4万亿,多场景表现出色,权威榜单冲进全球第一梯队,性能直逼Claude,且价格实惠,实测反馈良好。

量子位
算法论文8

ICLR 2026 | 7B小模型干翻GPT-5?AdaResoner实现Agentic Vision的主动「视觉工具思考」

文章介绍了AdaResoner模型,它学会‘何时用工具’,拼图推理上击败GPT - 5。Google为Gemini 3 Flash引入‘Agentic Vision’,与AdaResoner殊途同归。AdaResoner有独特训练方法,提升小模型性能。

机器之心
新闻资讯8

范式跃迁:LLM + EC重构算法设计范式,华为&港城大夺冠CVRP国际顶级赛事

近日,华为与港城大联合团队‘OptVerse - CityU’CVRPLib BKS全球挑战赛夺冠。他们用‘大模型(LLM)+进化计算(EC)’架构,刷新98个历史最优解,51个设新纪录,验证AI算法设计潜能。

机器之心
新闻资讯7

OpenAI将发布AI Agent浏览器,挑战谷歌Chrome

路透社消息,OpenAI将未来几周发布AI Agent驱动的网络浏览器,或挑战谷歌Chrome。其设计让部分交互聊天界面完成,还能整合产品自动执行任务,不过也面临激烈竞争。

AIGC开放社区
产品应用8

准确率轻松翻倍!不烧钱微调,AI靠“写日记”实现能力跃升

Memento - Skills系统抛弃大量算力微调模型参数的方式,靠读写反思、“写日记”式学习机制,不改变模型参数下实现能力跃升,GAIA和HLE基准实验中准确率显著提高。

AIGC开放社区
算法论文8

快慢Reasoning综述!

大型语言模型复杂推理任务中有‘无差别计算’缺陷,阻碍其多场景应用。本文提出双层效率优化框架,梳理两类前沿技术,通过实验揭示瓶颈,为轻量化推理指明路径。

深度学习自然语言处理
新闻资讯8

GPT-6 Astra 正式登场:烧了 10 万块 GPU、多项跑分逼近满分,OpenAI 总裁:我们迎来 AGI 时代

今天凌晨,OpenAI正式发布GPT - 6 Astra。它多项跑分逼近满分,OpenAI总裁称其或意味着AGI时代开始。该模型多方面能力领先,安全措施升级,将‘未来几天’面向部分用户推出。

AI前线
算法论文8

AAAI 2026 Oral | 告别注意力与热传导!北大清华提出WaveFormer,首创波动方程建模视觉

北大清华团队AAAI 2026 Oral论文中提出WaveFormer,首创用波动方程建模视觉。它将特征传播写成欠阻尼波动方程,实现频率 - 时间解耦,多任务验证中速度、效率与精度全面超越。

机器之心
算法论文8

少量视角也能得到完整3D几何,即插即用的语义增强重建插件来了

现有神经隐式路线样本稀疏时有跨视角对应不稳等问题。上海交通大学等团队提出SERES,将跨视角语义一致性作先验注入模型,以低成本解决歧义问题,多场景提升重建质量。

机器之心