C2LLM」共找到 2914 篇相关文章

开源动态8

超越GPT-4o和Gemini 2.5!小米MiMo-Audio音频大模型真香

小米推出MiMo - Audio大模型,预训练数据超1亿小时。它在多个基准测试成开源7B模型SOTA,开放相关资源。分词器表现佳,有全新架构,在音频理解、对话、推理等方面表现出色,还集成TTS功能。

AIGC开放社区
算法论文8

突破LLM数据瓶颈:Meta等提出语言自我博弈,一台模型,两个角色,无限进化

Meta等团队提出“语言自我博弈”(LSP)框架,让语言模型自己和自己“玩游戏”,在无外部数据输入下自我改进。实验显示,其性能可媲美甚至超越用大量人类数据训练的模型,为缓解数据稀缺提供新思路。

深度学习自然语言处理
算法论文8

1052篇文献!上海AI Lab发布科学LLM综述:从数据基础到Agent前沿

上海AI Lab主导,25家研究机构共同梳理270+训练集、190+评测集,提出科学数据分层框架与智能体闭环科研新范式。还介绍了模型演进、数据情况、评估基准等,指出数据缺陷并展望走向科学家智能体的三步。

PaperAgent
推荐文章7

LLM 商业化猜想:OpenAI 会走向 Google 的商业化之路吗?|AGIX PM Notes

文章探讨了大模型商业化难题,对比 OpenAI 潜在变现方案与 Google 商业模式,分析 OpenAI 开启类似 Google 商业化引擎的可能性,还给出 AI 搜索引擎可能的变现思路,并总结了本周市场情况及 AI 公司动态。

海外独角兽
开源动态8

科学智能2.0的「最强大脑」!上智院复旦无限光年联合发布开放平台

WAIC 2025上,上海科学智能研究院、复旦大学、无限光年联合发布「星河启智科学智能开放平台」。它以六大核心能力打造科学智能生态、驱动科研范式变革,致力于实现「科学的AI次方」效应。

新智元
产品应用7

Qwen3接连放出No Thinking, Thinking两大模型,Gemini2.5 pro顶不住啦

Qwen推出非推理模型`Qwen3 - 235B - A22B - Instruct - 2507`后,又放出推理模型`Qwen3 - 235B - A22B - Thinking - 2507`。非推理模型在多方面功能增强,推理模型能力强,超DeepseekR1,可试用。

CourseAI
推荐文章8

AI 基础知识从0.1到0.2——用“房价预测”入门机器学习全流程

文章以“房价预测”为例,介绍算法工程师开发模型全流程,包括需求分析、数据收集、划分数据集等十步。详细讲解各步骤操作,如用均方误差衡量模型效果,还提及多种模型及调优方法,助开发者入门机器学习。

阿里云开发者
算法论文8

ICML 2025 | M+框架来了,增加LLM隐空间记忆,不再受上下文窗口限制

本文提出M+长期隐空间记忆扩展框架,在MemoryLLM之上,将8B级模型有效记忆跨度从不到20k提升到160k+,显存占用不变。它解决了现有记忆模型冗余、冲突难解等问题,为下一代语言模型提供支撑。

机器之心
新闻资讯8

别跟LLM太交心!斯坦福新研究:AI不能完全取代人类心理治疗师

斯坦福大学研究团队测试流行AI模型及商业化AI治疗平台,发现AI治疗师存在根本缺陷与潜在危险,如歧视回应、无法危机干预、谄媚等,但也认可其在心理健康方面的辅助用途。

量子位
算法论文8

用MoE打造DNA基础模型更强范式!人大实现seq2func全新突破

中国人民大学团队提出SPACE模型,通过引入物种感知编码器和谱系分组增强解码器,革新架构,提升了DNA基础模型性能与泛化能力,在多项测试中表现优于主流模型。

新智元