通用推理能力」共找到 5082 篇相关文章

算法论文7

NICE59期 | Agent进入下一篇章!Alita:不靠人工预设,自己造MCP自我进化的AI

这篇论文提出让 Agent 主动创造解决 MCP 的工具实现自我进化,工具可网上检索或自主编写。Alita 做法更通用实效,还提出‘Agent 蒸馏’思想,其生成的 MCP 已用于‘manus’。

深度学习自然语言处理
开源动态7

DeepSeek 新模型 R1-0528 悄悄开源,与o3 相当,实测来了。

DeepSeek团队悄无声息地在Hugging Face上开源推理模型新升级版DeepSeek R1-0528,基于DeepSeek-V3-0324模型,架构和训练方法有改进,性能与o3相当,实测表现不错。

AI进修生
开源动态8

准确率92.7%逼近Claude 3.5、成本降低86%,开源代码定位新神器LocAgent来了

OpenHands 等团队发布 LocAgent,这是用于代码定位的图索引 LLM Agent 框架,准确率达 92.7%。它把代码库解析成图,提供工具接口,经实验效果出色,开源微调模型降本增效,还能提升问题解决率。

机器之心
新闻资讯7

大模型之后,AI 开始“自己动手”了

从生成式AI到Agentic AI,互联网从“信息获取”转向“任务完成”。全球科技巨头抢滩智能体,国内腾讯云升级智能体开发平台。腾讯吴运声表示,技术与业务需求双轮驱动其发展,还分享了应对落地挑战的办法。

AI科技大本营
算法论文8

DiffMoE:动态Token选择助力扩散模型性能飞跃,快手&清华团队打造视觉生成新标杆!

清华大学和快手可灵团队推出DiffMoE,通过创新的动态token选择机制和全局token池设计,拓展了扩散模型的效率与性能边界。实验表明,DiffMoE在多方面超越现有模型,未来集成先进技术或有新增益。

机器之心
新闻资讯8

Gemini 2.5 Pro登顶三冠王!AI最强编程屠榜,全面碾压Claude 3.7

谷歌Gemini 2.5 Pro(I/O版)横空出世,登顶LMAreana获文本、视觉、编码三连冠,编程能力碾压Claude 3.7。开发者可通过Google AI Studio等使用,其应用演示展现强大实力。

新智元
产品应用8

一手实测 Amazon Quick:我看到了企业级 Agent 的未来!

本文针对企业AI工具碎片化、员工沦为Agent间搬运工的痛点,对刚GA发布的亚马逊云科技Amazon Quick做一手实测,分析其核心能力与壁垒,判断企业级Agent发展趋势。

特工宇宙
新闻资讯8

拒绝OpenAI和Anthropic邀约,DeepMind安全研究员离职转向独立测评

本文报道,多名头部AI机构研究员因AI安全顾虑离职,DeepMind AGI安全研究员Engels拒绝OpenAI、Anthropic邀约,加入独立评测机构METR,围绕AI递归自我改进失控风险展开讨论。

DeepTech深科技
新闻资讯9

OpenAI总裁:AGI时代来了!GPT-6已能自主干活24小时

本文报道OpenAI总裁Greg Brockman在a16z访谈中的发言,Brockman宣布已进入AGI时代,介绍GPT-6的能力跃升,分享OpenAI在AGI发展、AI安全对齐等方面的最新判断与动作。

新智元
新闻资讯8

突发!反噬来了,英伟达限制使用 Anthropic 模型

本文爆料突发AI行业事件:Anthropic发布新模型后推出强制数据留存政策,推翻此前和企业签订的零数据保留协议,引发数据安全担忧,英伟达等三家巨头率先限制使用其模型。

AI寒武纪