多语言推理」共找到 6071 篇相关文章

开源动态8

字节突然开源Seed-OSS,512K上下文碾压主流4倍长度!推理能力刷新纪录

字节跳动突发开源360亿参数的Seed-OSS-36B,呼应OpenAI开源策略。它有512K超长上下文,引入“思考预算”机制。项基准测试达开源SOTA,字节Seed团队此前也开源个项目。

量子位
新闻资讯7

国产GPU赛道又跑出一个 2700 亿独角兽!“中国AMD”沐曦股份完成IPO,开盘大涨超 500%

继摩尔线程后,沐曦集成电路登陆科创板,截至发稿估值破 2700 亿。其核心团队来自 AMD,产品覆盖领域。虽三年累计净亏超 30 亿,但营收增长强劲。沐曦上市标志国产 GPU 进入“市场与资本检验期”。

AI前线
算法论文7

无需准确传感信号!轻松搞定「段软体机械臂」复杂位姿与形状控制

研究人员提出利用双向循环神经网络(biLSTM)的MSCA规划与控制策略,即便用不准确内部传感信号也能完成任务。实验显示该方法在任务中表现优异,未来还将做进一步研究。

新智元
开源动态8

一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元

Deep Cogito 是旧金山 AI 初创公司,开源四款混合推理模型。最大 671B MoE 模型性能超 DeepSeek v3 等,推理链比 DeepSeek R1 短 60%,训练成本不到 350 万美元。核心方法是迭代蒸馏与增强。

机器之心
推荐文章7

后端架构新范式!阿里云专家亲揭:用RocketMQ彻底搞定Agent异步协同难题

文章整理自阿里云专家演讲,介绍基于 Apache RocketMQ 新特性构建异步化 Multi - Agent 系统,探讨 Agent 间异步通信等机制,指出 Multi - Agent 协同关键,还讲了 RocketMQ 新特性及如何构建异步系统。

AI科技大本营
开源动态8

国产王炸!上海AI Lab开源Lumina-DiMOO,开创模态理解与生成新范式

上海人工智能实验室等机构推出模态生成与理解统一模型Lumina - DiMOO,采用全离散扩散架构。它解决传统模态架构问题,有全离散扩散建模等四大创新,性能在基准测试中领先,应用前景广。

AIGC开放社区
开源动态8

LeCun世界模型出2代了!62小时搞定机器人训练,开启物理推理新时代

Meta开源发布V-JEPA 2世界模型,图灵奖得主Yann LeCun称其将为机器人技术带来新时代。该模型能理解物理世界,经训练后在方面表现优异,Meta还发布新基准测试,也透露了后续计划。

量子位
新闻资讯8

刚刚,GPT-6代号再泄露!或将周四见

据传GPT - 6本周将发布,OpenAI「义父」爆料Codex接入最强Astra模型,其内部代号「mewfour」泄露。Astra内部版已解决个数学难题,成本仅约2000美元,还或达网络安全最高能力阈值,可能开启智能体原生时代。

新智元
新闻资讯8

【AAAI 2026大会特邀报告】从推理到科学发现:AI迈向可精专通才之路

上海人工智能实验室周伯文在AAAI 2026大会提出,当前处于AGI前夕,需通专融合智能。他认为可深度专业化通用模型是实现AGI的可行路径,科学发现是AI前沿,还介绍了SAGE架构及相关成果。

OpenMMLab
产品应用8

GLM-5正式发布,744B参数,对标Claude

GLM-5正式发布,对标Claude,参数从355B扩至744B,预训练数据增加。采用GlmMoeDsa架构,部署成本降低。数据表现佳,在测试中成绩亮眼,还能直输Office文档,部署支持框架和国产芯片,早期反馈积极。

AI工程化