从零训练」共找到 4880 篇相关文章

开源动态8

仅用图像也能Think:Google等提出一种视觉规划的全新推理范式!

剑桥和Google等提出并开源视觉规划范式,通过纯视觉表示规划,独立于文本。还引入VPRL框架,用GRPO后训练大型视觉模型。实验选三个视觉导航任务,VPRL表现最佳,显著优于其他方法。

PaperAgent
开源动态8

通义实验室新研究:大模型自己「扮演」搜索引擎,提升推理能力无需搜索API

阿里通义实验室开源ZeroSearch,提供无需与真实搜索引擎交互的强化学习框架。它用模拟搜索环境和渐进式抗噪训练,让LLM自给自足,节省API成本,在多问答数据集表现优,为智能化检索提供新思路。

量子位
新闻资讯7

一个提示攻破所有模型,OpenAI谷歌无一幸免!

HiddenLayer研究发现一种「策略傀儡」提示,将危险指令伪装成配置片段,配上角色扮演,能让ChatGPT等主流大模型开启「无限制模式」。此策略利用训练弱点,难修复且可扩展,厂商需智能监控。

新智元
产品应用7

一份PPT 创 5000万美金ARR,挑战微软和Google,这家华人创业AI公司火了丨PMF 001

本文介绍华人团队创办的AI PPT企业Gamma,它获5000万用户,ARR破5000万美金且连续盈利15个月。其精准踩中AI节点,运用PLG模式打败Tome,AI PPT升级为创意创作平台。

鲸选AI
新闻资讯7

4个MIT的00后,两年干出全球最火AI编程工具,600亿美元卖给了SpaceX

今年1月,Cursor CEO Michael Truell决定训练自有模型,不再依赖Anthropic的Claude。5个月后,SpaceX以600亿美元收购Cursor母公司。此前Cursor增长快但依赖Claude,自研模型有成本优势却缺算力。

DeepTech深科技
新闻资讯8

同一天两件大事!小模型直接掀翻千亿参数,走向效率为王

5月13日AI圈有两件大事,何恺明团队发布语言模型ELF,面壁智能开源MiniCPM-V 4.6。二者显示AI正‘堆算力’转向‘省算力’,拉开AI轻量化浪潮序幕,未来小模型或成关注方向。

AI科技评论
新闻资讯8

OpenAI闪电吞下Astral!Python开发者工具链沦陷,AI要住进你的终端

OpenAI宣布收购Python工具链明星公司Astral,团队并入Codex。Codex周活已破200万。AI编程入口之争「谁的模型更强」升级为「谁能定义开发者的工作流」,OpenAI此举意在抢入口。

新智元
算法论文8

ICCV 2025 | 机器人自主探索未知复杂空间?GLEAM破解主动探索建图的泛化难题

文章聚焦机器人在未知复杂空间的自主探索建图难题。香港中文大学与上海人工智能实验室联合提出GLEAM,搭建GLEAM - Bench基准,设计通用策略,实现样本适配未知空间,在多指标上超越先前方法。

机器之心
开源动态8

公开模型一切,优于DeepSeek-R1,英伟达开源Llama-Nemotron家族

英伟达推出面向高效推理的 Llama-Nemotron 系列模型,包括 Nano、Super、Ultra 等规模,具备卓越推理能力与效率,采用开放许可。模型支持动态推理切换,训练结合多方法,性能优于 DeepSeek-R1 等。

机器之心
新闻资讯7

GitHub 推出 MCP 服务器集成,全面扩展机密扫描功能

GitHub宣布MCP Server全面支持机密扫描功能,将其扩展至AI辅助和代理驱动的开发工作流,可让外部工具和AI工作流访问安全洞察、自动化修复。这反映安全工具正被动检测转向自动化治理。

InfoQ