长序列训练」共找到 2701 篇相关文章

算法论文8

首个3D动作游戏专用VLA模型,打黑神话&只狼超越人类玩家 | ICCV 2025

淘天集团未来生活实验室团队提出首个3D动作游戏专用VLA模型CombatVLA,已被ICCV 2025接收。它能处理视觉输入输出动作指令,在战斗理解准确率和执行速度上表现优异,还构建了评测基准等。

量子位
开源动态8

Meta刚刚开源DINOv3,横扫60+任务,无标注封神!

今天凌晨,Meta开源视觉大模型DINOv3,采用自我监督学习,无需标注数据。它在60多个视觉任务测试中表现出色,超越同类模型。还引入后处理优化策略,扩展应用场景,能适应多种部署环境。

AIGC开放社区
新闻资讯7

华为版CUDA,全面开源了

华为宣布为昇腾AI GPU开源CANN软件工具包及Mind系列套件、工具链,让昇腾更好用。CANN类似华为版CUDA,目前到8.0版,支持多深度学习框架。同日,传奇GPU架构师创业公司浮出水面,挑战英伟达。

量子位
新闻资讯8

奥特曼:ChatGPT只是意外,全能AI智能体才是真爱!Karpathy:7年前就想到了

当全球为ChatGPT喝彩,OpenAI的MathGen团队秘密锻造AI「推理」能力,打造全能AI智能体。OpenAI坚信推理能力可复制到各领域,未来AI智能体将颠覆一切,如今围绕人才的战争已白热化。

新智元
开源动态8

The Batch: 855 | 为智能体而生

总部位于北京的 Moonshot AI 发布 1 万亿参数的 Kimi K2 系列大语言模型,包括预训练和微调版本。它输入输出能力强,架构独特,在多基准测试领先,支持工具调用,多家服务商已集成。

DeeplearningAI
产品应用8

不拼参数,拼认知:工业AI的边界与深水区 | 甲子光年

如今AI渗透工业各环节,形成“大小协同”格局,但面临场景复杂、数据孤岛等挑战。西门子凭借深厚积累构建工业体系,其Industrial Copilot等产品落地中国,还自研基础模型突破瓶颈,围绕‘AI for Real’理念布局。

甲子光年
开源动态8

当大模型陷入幻觉循环,如何用工程化给它“立规矩”?

普林斯顿和伯克利研究定义“机器胡扯”,指出大模型胡扯问题。蚂蚁集团旗下蚂蚁密算在2025 WAIC提出高阶程序(HOP)框架,为大模型注入规则,还开源此框架,其在多行业场景应用效果良好。

InfoQ
新闻资讯7

为什么Cloudflare无法阻止Google为AI 模型爬取网站数据?

Cloudflare推出阻止AI爬虫抓数据功能,却对Google无效。因Googlebot身兼两职,Cloudflare难区分其请求目的。出版商流量因Google AI功能下降,网站主在被剥削和失去流量间两难。

AGI Hunt
推荐文章7

如何判断 AI 将优先自动化哪些任务?

思考AI优先自动化哪些任务,可从‘描述 - 执行鸿沟’视角出发。‘描述 - 执行鸿沟’大的任务是自动化沃土,反之自动化价值有限且创建训练数据难,它与‘判别器 - 生成器鸿沟’相似又不同。

宝玉AI
新闻资讯8

扒光谷歌Gemini 2.5:一份官方“翻车报告”,揭露AI Agent的8个秘密。

谷歌DeepMind发布Gemini 2.5技术报告,以玩《宝可梦 红/蓝》为例,展示构建有效智能体的案例。该系统架构由多部分组成,但运行状况百出,如上下文过变差、产生幻觉等,也有亮点,还能提炼避坑方法。

探索AGI