无数据训练」共找到 4403 篇相关文章

8

AI真的需要「像人类」那样思考吗?AlphaOne揭示属于大模型的「思考之道」

近年大模型在推理任务有进展,但缺乏推理节奏调控能力。伊利诺伊大学厄巴纳 - 香槟分校和加州大学伯克利分校研究提出 AlphaOne 框架,引入 α - moment 实现训练的推理调控,实验显示其能提升准确率和效率。

机器之心
算法论文7

AI竟会「自己认错」?破解多智能体协作「罗生门」,斩获ICML 2025 Spotlight

多智能体AI系统任务失败后,开发者常难定位问题。PSU、杜克大学与谷歌DeepMind等机构提出「自动化失败归因」,发布Who&When数据集,探索三种归因方法,虽目前效果欠佳,但为打造可靠系统提供方向。

新智元
推荐文章8

来吧,往死理卷,9.8K Star TypeWords~~~

本文推荐Star量9.8K的开源背词项目TypeWords,针对「眼熟单词写不出」的痛点,设计了提示输出的练习闭环,面向技术人给出使用指南,同时说明其本地存储特性与同步限制。

小华同学ai
新闻资讯7

The Batch: 945 | 制药巨头大举押注 AI

制药巨头 Eli Lilly 向 Insilico Medicine 提供最高 27.5 亿美元,用于药物研发。Insilico 用生成式 AI 进行药物发现,从靶点到分子设计效率高,虽尚 AI 药获批,但显示出潜力。

DeeplearningAI
开源动态8

极客大神构建了LLM架构画廊,AI大神Karpathy点赞

极客大神Sebastian Raschka构建LLM Architecture Gallery,将复杂模型结构化繁为简,引发技术圈讨论,AI大神Karpathy点赞。画廊高度视觉化、互动性强,展示模型架构图及核心参数,源数据开源。

AIGC开放社区
算法论文8

阿里新研究:统一了VLA和世界模型

阿里达摩院等提出WorldVLA框架,融合视觉语言动作模型与世界模型。它用三套分词器编码,解决传统自回归模型问题,经联合训练,实验显示其性能优,两模型还能相互助力。

量子位
开源动态8

人人都能炼专属Agent,上海交大开源端侧Agent全栈工具链,真实场景性能超GPT-5!

上海交大开源端侧Agent全栈工具链MobiAgent,将构建手机Agent全流程开放。它在真实场景性能超GPT - 5,还设计“潜记忆加速器”,通过三步养成Agent,评测表现出色,降低移动智能体开发门槛。

机器之心
新闻资讯8

从Token到词元:全模态时代的基模与交互入口

2026年3月24日国家数据局确立“词元”为Token标准译名,Token生成与消耗方式在多模态场景正发生变化。模思智能获数亿融资,探索从语音到全模态的路径,成果颇丰且完成能力闭环,其发展受关注。

量子位
开源动态8

「被动感知」到「理解接触」!它石智航重磅发布OmniVTA视触觉世界模型

它石智航联合六大顶尖机构推出OmniVTA视触觉操作框架和OmniViTac大规模视触觉数据集。该框架核心是从被动感知到主动预测触觉,通过多模块协同让机器人有预测、理解和修正能力,实验表现优。

新智元
新闻资讯7

图解GPT-OSS:架构、消息格式与推理机制等

OpenAI发布首个开源大模型GPT-OSS,虽性能惊喜,但设计思路有意思。其架构是经典延续,消息格式有巧思,支持三档推理模式,分词器有小进步,这些设计在实际应用和理论上有一定价值。

AI工程化