「数据消费范式」共找到 3373 篇相关文章
字节发布通用游戏智能体!5000亿token训练,用鼠标键盘吊打GPT-5!
字节seed团队打造通用游戏智能体Game-TARS,基于键盘—鼠标动作空间训练,用超5000亿标注量级数据,结合新技术提升扩展性和泛化性,在多类游戏任务中表现超越GPT - 5等模型。
Depth Anything再出新作!浙大&港大出品:零样本,优化任意深度图
浙江大学与港大团队推出「Prior Depth Anything」,融合深度传感器数据与AI深度图,一键补洞、降噪、提分辨率。无需额外训练,可提升3D模型深度质量,零样本刷新多项深度处理纪录。
开源复现o3图像思考!快手让AI不再被动看图,模型自主生成代码调用工具
Kwai Keye团队提出Thyme新范式,构建技术方案,赋予开源模型“超越图像思考”能力。包括设计训练策略、构建开源配套资源,拓展多模态模型工具使用与决策水平,在基准测试中性能提升显著。
直播预约 | 强化学习训练能否不依赖外部知识优化模型的弱点?
论文提出 SwS 框架,针对强化学习场景,利用模型自我感知弱点驱动自动化问题生成,合成针对性训练数据。还对其进行多项扩展,在多个基准测试集和模型上验证有效,性能提升显著。
JCP | 南科大赵肃楠、王建春等:LESnets:基于物理信息神经算子的湍流大涡模拟
本研究提出基于物理信息神经算子的LESnets方法,用于快速模拟粗网格上三维湍流时空演化。不使用标签数据,训练两种神经算子,验证了其有效性和泛化能力,效率显著优于传统方法。
硅谷巨震!Alexandr Wang加入Meta,一夜之间让OpenAI、微软、谷歌沦为“透明人”
年仅28岁的Scale AI创始人Alexandr Wang离职加盟Meta,Meta为此进行150亿美元巨额战略投资。他掌握AI核心数据和对手底牌,扎克伯格此举或助Meta在AI竞赛中扭转劣势。
Grok最新模型吃上Cursor「加餐」,马斯克:Coding实现巨大改进
马斯克在X上透露,xAI的Grok基础模型V9 - Medium(1.5T)完成训练,预计2 - 3周后发布,训练加入大量Cursor数据。同时,xAI的AI编程代理工具Grok Build进入早期Beta测试阶段。
谷歌TurboQuant会绕过“内存墙”?这个判断有点过了|甲子光年
谷歌发布的TurboQuant论文引发市场震动,其算法可将大语言模型推理的KV缓存大幅压缩并加速。但将其视为绕过‘内存墙’判断过度,它提升单位字节信息密度,改变边际需求曲线,代表范式转移。
港大刚刚开源了 CLI-Anything!一个命令让任意软件秒变 AI Agent 原生工具!
香港大学数据科学实验室团队开源 CLI - Anything,它以 CLI 为桥梁,将人类软件转变为 Agent 能用的工具。该项目有一键生成 CLI、真实软件集成等亮点,还给出快速入手步骤和使用示例,未来规划宏大。
AI招聘逆天研究:看照片预测一生职业成就
硅谷大厂HR标配的AI招聘系统Eightfold AI被指控算法歧视,求职者要求提高招聘筛选透明度。同时,美国多所高校研究者完成一项研究,AI能通过人脸照片预测职业走向,但因训练数据问题引发公平性争议。