新需求」共找到 4191 篇相关文章

新闻资讯7

Karpathy盛赞DeepSeek-OCR“淘汰”tokenizer!实测如何用Claude Code 让模型跑在N卡上

DeepSeek发布模型DeepSeek - OCR,在实用场景达SOTA且token消耗最少。Karpathy赞其或淘汰tokenizer,Pleiasfr联合创始人称是里程碑。开发者Simon用Claude Code让模型在NVIDIA Spark上跑通。

InfoQ
新闻资讯7

骂战半年、站队失效,具身智能公司集体换了“剧本”,VLA“自救”成功了吗?

2026年具身智能赛道经历‘技术路线大分流’,VLA遭质疑,‘世界模型’和VA路线兴起。具身智能进入‘落地祛魅’阶段,厂商开始‘路线混搭’,VLA和世界模型都在进化,行业探索架构,具身智能无完整技术路线图。

InfoQ
新闻资讯8

突破三维感知瓶颈:魔芯科技发布VGGT系列成果,实现动态高保真重建并获一轮融资

魔芯科技联合同济大学等团队,基于 VGGT 架构发布四项成果,突破三维感知在流式处理、动态鲁棒性和精细感知上的瓶颈。还获一轮融资,后续将加大对空间智能与世界模型技术投入。

机器之心
新闻资讯7

代码为刃 创意为甲,探索国产AI应用路径 ——“算网杯”2025 AIGC开发者大赛圆满落幕

1月17日,“算网杯”2025 AIGC开发者大赛决赛在中国科大苏州高等研究院落幕。大赛受业界关注,吸引500余名开发者。以“探索国产AI应用路径”为导向,成果丰富,发掘了人才与项目,为产业注入动能。

AIGC开放社区
新闻资讯8

Karpathy盛赞DeepSeek-OCR“淘汰”tokenizer!实测如何用Claude Code 让模型跑在N卡上

DeepSeek发布模型DeepSeek - OCR,有诸多技术贡献,获Karpathy等盛赞。它或让文本token输入方式被淘汰。开发者Simon用Claude Code让其在N卡上运行成功,分享了详细过程与经验。

AI前线
新闻资讯7

DeepSeek 为什么把缓存涨了 11 倍?长上下文需求暴涨,得交点「存储税」了

8月17日,DeepSeek V4 Pro API输入和输出价格上涨,空闲时段缓存命中价涨5倍,高峰时涨11倍。此前其因高缓存命中率成性价比之选,但长上下文需求爆发致后端“缓存颠簸”,只能通过涨价收“存储税”。开发者可提高缓存命中率应对。

AI科技评论
推荐文章7

《中国Data&AI数据基础设施白皮书》——AI创生核心生产力,开启万亿基建之路 | 甲子光年智库

全球正处地缘政治与AI技术变革中,AI跃升为核心生产力。中国企业面临‘挤压式转型’,传统数据系统难满足需求。数据厂商需构建一代数据基础设施,技术上‘湖仓一体’与‘AI原生’融合,推动Data&AI一体化。

甲子光年
开源动态8

ICML 2025 | 长视频理解SOTA!蚂蚁&人大开源ViLAMP-7B,单卡可处理3小时视频

在视觉语言模型取得突破的当下,长视频理解挑战凸显。蚂蚁和人大团队提出视觉语言大模型ViLAMP,采用‘混合精度’策略,在多基准测试中超越现有方案,单卡可处理3小时视频,为实际应用带来可能。

机器之心
算法论文8

推翻「预测下一个token」范式!微信AI研究:把token压缩成连续向量更具性价比

微信AI和清华团队提出范式CALM,把token打包成连续向量,让大模型从预测下一个token转变为预测下一个向量。实验表明它能减少生成步骤,在平衡性能和计算成本时性价比更高。

量子位
算法论文8

MeanFlow再下一城,北大提出机器人学习范式MP1,实现速度与成功率双SOTA

北大研究团队提出机器人学习范式MP1,将MeanFlow引入机器人学习,实现毫秒级推理速度。还引入分散损失提升少样本泛化能力,在仿真和真机测试中,实现速度与成功率双SOTA。

机器之心