「多语言能力」共找到 7038 篇相关文章
拒绝视频生成,深度跃迁提出具身基座模型全新路线
深度跃迁发布世界动作模型 DELE - w0.5,放弃基于视频生成模型的路线,训练时联合学习动作与未来世界表征,推理时移除该表征分支。在真机实验中表现超基线,具跨背景泛化能力,为世界模型提供新思路。
GPT之父:只用上世纪数据训AI,它居然也会写Python?!
GPT之父Alec Radford团队训练出talkie - 1930 - 13b模型,其训练数据截止1931年。该模型能说新政立法、写Python代码。团队还对比其与现代模型,发现核心能力差距不大,且用老语料调教它成聊天助手时现风格问题。
全国首部可信AI“技术安全+数据合规”标准来了,欢迎参与起草!
2025年国家数据局开展可信数据空间试点,在多领域落地经验。但实践中技术、合规等问题凸显。中国电子商会归口、智合标准中心起草《人工智能大模型可信数据协作安全与合规指南》,有诸多亮点,现公开征集起草单位和起草人。
刚刚,小红书开源了首个多模态大模型dots.vlm1,性能直追SOTA!
小红书人文智能实验室(hi lab)低调开源视觉语言模型dots.vlm1。该模型基于自研视觉编码器构建,在视觉理解和推理任务上接近SOTA水平,实测表现惊艳,还介绍了其技术架构、预训练数据布局等内容。
国产「3D版Anthropic」再获数亿融资!60人初创,卡住全球3D脖子
影眸科技完成数亿元新一轮融资,发布全球首个具千万面级生成能力、引入‘先思考、再生成’逻辑的3D大模型Hyper3D Rodin Gen - 2.5。其有诸多优势,获多巨头认可,目标是定义空间智能底层规则。
AI玩宝可梦找出30年前代码Bug!谷歌论文介绍AI通关全过程,复杂任务都能解
谷歌Gemini 2.5系列技术报告花长篇幅介绍Gemini 2.5 Pro玩《宝可梦蓝》,它通关游戏,展现出创造力与长期规划能力,还发现游戏代码Bug,但也有幻觉、思维定势等问题。Claude 4已加入比赛。
让大模型学会「自己教自己」!京东&中科院信工所连发三篇论文定义Self-Taught RLVR
京东和中科院信工所开展Self - Taught RLVR系列研究,连发三篇论文。从RLSD、NPO、CoPD三个维度探索让大模型自我指导。如RLSD解决信息泄漏,NPO引入有效学习信号,CoPD整合多专家能力,各有创新与良好效果。
首篇自进化智能体系统技术报告出炉:Token成本直降近10倍,省钱又高效!
全球首个基于‘上下文信息密度最大化’的自进化智能体系统GA发布技术报告。它在多基准测试表现惊艳,能省近10倍Token,还能自我进化。报告深度解读设计理念,剖析自进化能力与智能体设计思路。
接入 MiniMax M2.7 后,我的 OpenClaw「超进化」了
作者实测 MiniMax 新模型 M2.7,其在基准测试、代码能力、多智能体协作等方面表现出色。接入 OpenClaw 后,能高效完成复杂任务。M2.7 指令遵循率高、长上下文处理能力强且价格低,有望提升 Agent 生态表现。
模力工场 033 周 AI 应用榜:从评论区互动到游戏陪玩,AI 已悄悄加载完成
模力工场 033 周 AI 应用榜发布,展示了 AI 在各领域的应用。各大厂选择在原有产品里做能力延伸,开发者将分散的 AI 功能整合。榜单涵盖学习、生活、娱乐等多领域应用,AI 更便利、隐形地融入日常。