纯语言能力」共找到 4151 篇相关文章

推荐文章7

APP 是功能的软件化,Skill 是经验的软件化

文章指出移动互联网时代人类把需求装进 APP,Agent 时代则把经验装进 Skill。当前多数人未充分使用 AI,微信接入 Openclaw推动大众拥抱 AI。Skill 是新旧世界耦合点,还具备进化能力,可形成复利。

AI产品黄叔
产品应用7

GEAClaw 来了:企业级“OpenClaw”,一只有商业头脑的龙虾

文章指出当前大语言模型解决问题多为收敛式,与商业问题需先发散再收敛的方式相悖。特赞发布企业级智能体系统GEA,其架构四层分工明确,能在市场洞察、社媒增长等场景发挥作用。

AI寒武纪
新闻资讯8

黄仁勋 × Lex Fridman:NVIDIA 4 万亿市值背后的 AI 革命

黄仁勋与Lex Fridman进行两小时访谈,从Amdahl定律聊到人类意识。谈及NVIDIA发展,如CUDA决策致市值下跌后回升;提出AI扩展定律,认为智能由算力决定;还分享管理、技术预判等看法及对中国创新的评价。

宝玉AI
算法论文8

拒绝「降智、减配、乱收费」:面向LLM API的可信验证框架

语言模型成AI应用基础设施,黑盒服务模式引发信任危机。研究者提出IMMACULATE审计框架,能在不暴露模型信息、仅1%额外开销下,验证黑盒LLM API执行完整性,检测违规行为,相关论文与代码已公开。

机器之心
算法论文8

以「图」破局,HyperOffload定义超节点存储管理新范式

随着生成式AI进入万亿参数时代,大语言模型面临“显存墙”挑战。上海交大与华为MindSpore团队发布技术报告《HyperOffload》,其核心技术集成于MindSpore 2.8,能提升超节点异构资源协同效率,已在多项目落地。

机器之心
开源动态8

500行极简开源框架,硬刚GPT/Gemini视觉极限!

多模态大模型代码能力进步大,但基础视觉任务常失误。UniPat AI构建SWE-Vision框架,让模型用代码处理视觉判断,在五个视觉基准测试达最优,其极简设计有效且泛化性强,代码已开源。

新智元
开源动态8

卡帕西630行代码炸出81个智能体,4天协作跑2333次实验,公布预训练十大发现

Karpathy的Autoresearch项目630行代码让AI自主实验,提升语言模型训练效率。全球开发者让多智能体协作,智能体自发形成同行评审制度。项目发起者公布十大发现,还衍生出表现出色的auto - discovery项目。

量子位
算法论文8

ICLR-26腾讯混元:Agent是强大的,但用户是狂野的

现有LLM工具使用基准测试场景理想化,忽视真实用户行为复杂性。腾讯提出WildToolBench,基于真实用户行为构建测试集,对58个模型评估,发现模型准确率低,揭示LLM在真实场景下能力缺口,为模型优化指明方向。

PaperAgent
算法论文8

ICLR 2026 | LongHorizonUI:让 GUI 智能体不再"半途而废"——面向长链路任务的统一鲁棒自动化框架

近年来,基于多模态大语言模型的GUI智能体在自动化操作上虽有进展,但任务步数超10 - 15步时成功率断崖下跌。研究人员提出LongHorizonUI框架,构建LongGUIBench评测基准,推动GUI自动化在复杂场景落地。

机器之心
8

陶哲轩对谈 OpenAI 高管:“试错成本”无限趋零,AI 正在把数学变成一门重工业

菲尔兹奖得主陶哲轩与OpenAI顶尖科学家Mark Chen对谈,探讨AI在数学研究中的能力、缺陷与演化路径。指出AI试错成本低,在数学领域发展潜力大,虽目前有局限,但正改变数学研究方式。

AI科技大本营