多语言推理」共找到 6107 篇相关文章

开源动态8

纯血国产!4B模型越级打怪,杀入万亿赛道

9月1日,Hugging Face上线星火X2.5-4B和1.7B开源端侧模型,在指标测试中表现优异,实现“越级打怪”。该模型基于全国产算力平台训练,在断网笔记本上实测效果惊艳,使用了两项技术提升能力,适配性强。

新智元
7

家芯片公司业绩飙涨,这个赛道彻底火了?

近期家A股芯片公司Q3财报亮眼,受益于端侧AI推进。端侧AI优势,吸引科技巨头布局,但落地有挑战。技术进步使大模型轻量化,手机与AI眼镜较热。其发展面临应用、技术、生态等问题,也有隐私保护方案。

芯师爷
算法论文8

无需NeRF/高斯点后处理,视频秒变游戏模型成现实!新方法平均每帧仅需60秒 | ICCV 2025

KAUST团队提出全新方法V2M4,能从单目视频直接生成高质量、显式的4D网格动画资源。该方法构建阶段流程,涵盖相机轨迹恢复等关键步骤,平均每帧约60秒,比现有方法显著提速,论文已被ICCV 2025接收。

量子位
新闻资讯8

ICML 2026前瞻:投稿翻倍背后,机器学习正在换挡

第43届国际机器学习大会(ICML 2026)7月6 - 11日将在韩国首尔举行,主题为‘Machine Learning for the Real World’。今年投稿量翻倍,接收率26.6%,还做了两项制度调整。论文反映出LLM推理、AI安全、模型压缩等趋势,中国研究者表现亮眼。

AI科技评论
新闻资讯7

谷歌迎来“DeepSeek时刻”!TurboQuant引爆AI圈、全球开发者疯狂复现:6倍无损压缩,内存股集体暴跌

谷歌研究院发布 TurboQuant 压缩算法,能在提升速度、保持准确性的同时,降低大语言模型内存占用,可将键值缓存压缩至少 6 倍,速度最高提升 8 倍。该技术无需额外训练,精度零损失。目前虽未大规模部署,但已引发内存股下跌。

AI前线
算法论文7

用超图撕开知识边界:16万节点无师自通搞Agentic科研

传统知识图谱只能用三元组描述世界,难以应对真实科学场景里的体交互。作者提出将文献里n元关系存成超图超边,让LLM在智能体框架里‘沿着超边走路’,并构建了超图进行实验,实现可验证的科学发现。

PaperAgent
推荐文章8

拒绝视频生成,深度跃迁提出具身基座模型全新路线

深度跃迁发布世界动作模型 DELE - w0.5,放弃基于视频生成模型的路线,训练时联合学习动作与未来世界表征,推理时移除该表征分支。在真机实验中表现超基线,具跨背景泛化能力,为世界模型提供新思路。

机器之心
新闻资讯7

全国首部可信AI“技术安全+数据合规”标准来了,欢迎参与起草!

2025年国家数据局开展可信数据空间试点,在领域落地经验。但实践中技术、合规等问题凸显。中国电子商会归口、智合标准中心起草《人工智能大模型可信数据协作安全与合规指南》,有诸亮点,现公开征集起草单位和起草人。

AI工程化
产品应用7

数据合成篇|轮ToolUse数据合成打造更可靠的AI导购助手

文章以租赁导购助理“小不懂”为例,介绍Tool Use训练数据合成方案。先分析训练数据的目标与难点,提出动态智能体对话生成框架,阐述轮数据、复杂问题合成及过滤方案,展示数据和模型效果,还提及未来工作方向。

阿里云开发者
开源动态7

AI Labs 都在用,ClickHouse 能成为 AI 日志的实时分析引擎吗?

过去18个月,ClickHouse发展迅猛,2025年末ARR达1.6亿美元,付费云客户超3000。它原是Yandex项目,适合LLM推理日志分析。通过收购拓展为数据平台,进入市场竞争。文章探讨其增长原因、产品、市场及优劣势等。

海外独角兽