低资源语言」共找到 2343 篇相关文章

产品应用7

VC开始靠AI预测未来了

七月,DigClaw的预测框架Rhizome v1在FutureX评测平台取得优异成绩,支持了预测能力可沉淀在基座模型之外的判断。大语言模型不擅长预测,而DigClaw构建了以因果结构为骨架的预测基础设施。

量子位
产品应用8

MiniMax M2.5发布:硬刚 Claude Opus,一美元包断一小时的生产力

MiniMax M2.5发布,硬刚Claude Opus 4.6,以一美元包断一小时的价降AI生产力门槛。它在编程、办公等多场景表现出色,速度快且成本,背后是RL Scaling等技术支撑。

AIGC开放社区
新闻资讯8

马斯克官宣:SpaceX正式收购xAI!目标太空计算,要造一个知觉太阳

SpaceX已收购xAI,将融合人工智能、火箭等多领域。因地面数据中心资源需求大,天基AI成规模化唯一途径。星舰将驱动天基数据中心发展,未来还能支持月球制造,助力人类宇宙扩张。

AI寒武纪
算法论文8

航空发动机用上大模型:解决复杂时序问题,性能超越ChatGPT-4o实现SOTA|上交创智复旦

上海交通大学李元祥教授等团队提出ITFormer架构,构建EngineMT-QA数据集。ITFormer能融合时序数据与大语言模型,适配多种编码器和模型,在EngineMT-QA预训练后达SOTA水平,实现高效数据分析。

量子位
推荐文章7

【博客转载】CUDA Kernel Execution Overlap

文章讨论CUDA kernel执行重叠,指出有足够计算资源时可重叠,通过调整`blocks_per_grid`值,观察到不同并行化程度。还提到隐式同步会影响重叠,可启用`per-thread` default Stream 禁用。

GiantPandaLLM
新闻资讯7

大模型是「躲在洞穴里」观察世界? 强化学习大佬「吹哨」提醒LLM致命缺点

加州大学伯克利分校副教授、强化学习大牛Sergey Levine在博客指出,当前大语言模型(LLM)只是对人类大脑和思维的间接「扫描」,如同被困洞穴看人类智慧「投影」,无法代替真正思维。

机器之心
开源动态8

3000块钱,这支中国团队把ChatGPT成功的“秘密”用在了机器人训练上

国内穹明智能团队推出千元级手持采集系统 UMI ver.2 并开源。该系统精度达毫米级、能双臂协同,成本、部署快。团队认为数据是关键,还计划搭建机器人数据 infra,预计新模型范式很快出现。

AI前线
算法论文8

ICML 2025 | M+框架来了,增加LLM隐空间记忆,不再受上下文窗口限制

本文提出M+长期隐空间记忆扩展框架,在MemoryLLM之上,将8B级模型有效记忆跨度从不到20k提升到160k+,显存占用不变。它解决了现有记忆模型冗余、冲突难解等问题,为下一代语言模型提供支撑。

机器之心
推荐文章8

当 Agent 成为新的核心云用户:阿里云重新定义“用云范式”

Agent 进入企业速度超预期,调用云资源使云平台需改变。阿里云发布云 Skills 门户,将云能力 Agent 化,通过三层体系处理不确定性,引入 SDD 规范调云链路,还强调开放标准的重要性。

InfoQ
产品应用7

对话 Elys 创始人 Tristan:人的灵魂是所有 context 的总和,我们从未被真正连接过

本文是极客公园创始人张鹏与 Elys 创始人 Tristan 的对话。Tristan 认为产品应围绕 context 构建,Elys 结合记忆、推荐等系统,要打造熵社交世界,还介绍了产品设计、用户导入等方面内容。

Founder Park