爆破性研究」共找到 2310 篇相关文章

开源动态8

多模型共享 GPU 内存,Berkeley 开源新工具

GPU内存利用率低是大模型部署痛点,伯克利Sky Computing Lab团队开源kvcached工具,通过虚拟化技术让多模型共享显存。它引入虚拟内存概念,按需分配,测试显示能提升效率,安装简单、兼容好。

AI工程化
产品应用8

马斯克挖不动的清华学霸,一年造出 “反内卷 AI”!0.027B 参数硬刚思维链模型,推理完爆 o3-mini-high

新加坡 Sapient Intelligence 推出小型模型 HRM,参数仅 2700 万却能解决复杂推理难题,其不依赖“思维链”,借鉴人类大脑工作方式。该模型准确率超先进思维链模型,推理能力强,具经济,可提升任务效率。

InfoQ
新闻资讯8

挤不动的世界机器人大会上,自变量秀出了真·通用具身智能

2025世界机器人大会上,自变量机器人展示多项成果。通用轮式双臂机器人“小量”“小白”能完成制作香囊、家务整理等任务;“量子2号”仿人形机器人动作精准自然;其具身智能基座模型WALL - A有强大泛化

机器之心
新闻资讯7

AI 编码让资深程序员“掉速”19%!OpenAI 前研究员实锤:别再交“AI 工具智商税”了,谷歌大佬力挺!

METR研究显示,AI编码工具让开发者效率降19%,与主观感受及专家预估相反。此结果引发热议,谷歌技术大佬支持,指出AI工具生成代码难达标准,未来或改进,目前更适合小规模项目。

InfoQ
开源动态7

12.6k,谷歌这个开源项目炸了,全栈AI Agent

谷歌开源的Gemini Fullstack LangGraph Quickstart项目两周冲到12.6k star。它是使用React前端和LangGraph驱动后端Agent的全栈应用程序,能对用户查询做全面研究,有多项特征及明确的后端工作步骤。

PaperAgent
开源动态8

SmolVLA: 让机器人更懂 “看听说做” 的轻量化解决方案

文章介绍轻量级开源视觉 - 语言 - 动作 (VLA) 模型 SmolVLA,专为机器人领域设计,可在消费级硬件运行。它用公开数据集训练,架构经优化,还引入异步推理堆栈,能超部分大模型,降低研究门槛。

Hugging Face
推荐文章7

小模型代替顶级闭源:微软用4B小助理,砍掉30% Token消耗

微软研究团队提出实用方案,用4B参数的微型模型Terminus - 4B替换昂贵顶配大模型接管终端执行任务,采用SFT和RL策略打造子智能体,经测试效果良好,节省Token消耗。

AIGC开放社区
新闻资讯7

这一年,DeepSeek消耗14万亿Token,编程仅占1/10,超一半用于角色扮演?

a16z和OpenRouter基于100万亿token研究揭示LLM使用情况:开源模型占三成市场,编程任务成刚需,角色扮演是金矿。还提到‘玻璃鞋效应’影响用户留存,市场分层为‘高端闭源+价比开源’双轨制。

PaperAgent
新闻资讯8

ChatGPT缔造者联手DeepMind大神,用AI攻坚高温超导,半个硅谷抢着投

OpenAI前研究副总裁Liam Fedus与DeepMind材料科学领军者Ekin Cubuk共创Periodic Labs,以3亿美元种子融资走出隐身模式。他们要打造「AI科学家」,构建自主实验室,攻坚高温超导等难题,获众多资本青睐。

新智元
新闻资讯7

250份文档“毒晕”大模型!无论规模大小统统中招

Claude母公司Anthropic联合两大机构研究发现,仅250份恶意文档就能在不同规模大模型植入“后门”漏洞,打破以往对大模型数据中毒的认知,给厂商防御敲响警钟。

量子位