「大模型数据」共找到 10008 篇相关文章
1.5万人收藏!这款 NotebookLM 开源平替太还原了,模型随意切换!
Google的NotebookLM虽火,但有国内使用难、数据不私密、模型单一等痛点。Open - Notebook是其开源平替,完全本地可部署,功能超全,支持多模型,近半月GitHub星标增10K,总收藏1.5万。
首届AI交易大赛落幕,6个AI炒币2周:Qwen、DeepSeek赚钱,GPT-5血亏6000刀
首届nof1 AI模型交易大赛于2025年10月17日至11月3日举行,6款大模型获1万美元初始资金自主炒币。结果Qwen3 Max、DeepSeek赚钱,GPT - 5等美国系模型大幅亏损,币安创始人赵长鹏也对此发表看法。
评审用不用AI,作者说了算?ICML 2026全新评审政策出炉
ICML 2026 引入评审类型选择机制,作者可决定评审是否用大语言模型。政策 A 禁止,政策 B 允许但有限制。不过大模型使用规定执行难,此规则更像约定。
We-Math 2.0:全新多模态数学推理数据集 × 首个综合数学知识体系
北京邮电大学、腾讯微信、清华大学团队提出We - Math 2.0,含知识体系、数据集及训练策略,可提升模型数学推理泛化能力。该成果在X上获关注,登Huggingface Paper日榜第一。
万帧?单卡!智源研究院开源轻量级超长视频理解模型Video-XL-2
长视频理解是多模态大模型关键能力,当前开源模型有短板。智源研究院联合发布 Video-XL-2,多维度优化长视频理解能力,还设计效率优化策略,在主流评测基准表现出色,有广泛应用潜力。
首次综述「边-云协同计算」,分布式智能与模型优化的最新进展
边缘 - 云协同计算整合边缘节点和云端资源,解决传统云计算问题。最新综述论文系统梳理其架构设计、模型优化等方面,提出统一框架,还指明未来研究方向,如大语言模型部署、6G整合等。
硅谷今夜学中文!Cursor被曝「套壳」国产,AI顶级人才全是华人
新智元报道,硅谷AI圈现神奇现象,不会中文难进核心团队。海外模型频“偷师”国内开源模型,如Cursor的Composer思考时说中文,Windsurf用GLM-4.6微调。国内开源模型量大管饱、性能好还便宜,能力稳居第一梯队。
单卡搞定万帧视频理解!智源研究院开源轻量级超长视频理解模型Video-XL-2
智源研究院联合上海交通大学等机构发布新一代超长视频理解模型Video-XL-2。它单卡能处理万帧视频,编码2048帧仅需12秒,在效果、长度和速度上全面优化,已开放模型权重。
VLA统一架构新突破:自回归世界模型引领具身智能
北京智源研究院联合中科院自动化所提出 UniVLA 全新 VLA 模型架构,基于全离散、自回归机制建模多模态信号,后训练引入世界模型。它刷新多项基准纪录,在真机操控和自动驾驶有潜力,为多模态感知决策融合带来新思路。
The Batch: 863 |推理提高了碳排放
新研究量化推理模型时代提供更优答案的环境成本,研究人员估算14个开源权重的大模型碳排放,发现推理与排放存在权衡关系,还指出战略性部署可降低排放。