大规模数据」共找到 6830 篇相关文章

推荐文章8

语言模型为何会“说谎”?6000字深度长文揭秘AI意识的萌芽

2023年12月至2024年5月,Anthropic发布三篇论文,证明语言模型会“说谎”,揭示了堪比人类心理的四层心智架构,可能是人工智能意识的起点。论文还分析了AI“说谎”原因,展示其意识萌芽,引发对赋予AI意识后果的思考。

AI科技大本营
产品应用8

阿里 Qwen3-TTS 两更新直接封神!支持跨物种音色克隆,3 秒复刻!

阿里通义上线 Qwen3-TTS 两核心能力,VoiceDesign 支持全文本控制音色特征,VoiceClone 能 3 秒音频跨语言、跨物种克隆音色。更新指标亮眼,如 0.1 秒级生成速度等,还可上手体验。

开源星探
开源动态8

智谱AI、清华开源新视觉模型:刷新41项纪录,同级别最强

智谱AI与清华联合开源GLM - 4.5V视觉模型,它基于GLM - 4.5 - Air开发,架构独特。在42项主流测试中创41项新纪录,多领域表现超Qwen2.5 - VL等模型,还采用新训练策略。

AIGC开放社区
算法论文9

从自己出题到自己选题:耶鲁新方法让模型 Self-Evolution 又进一步

本文解读了耶鲁、斯坦福等多机构联合提出的INFUSER模型自进化新方法,针对现有方法仅以难度筛选训练数据的缺陷,提出用影响力分数筛选高价值训练题,实现双模型协同动态进化,实验验证效果显著。

深度学习自然语言处理
算法论文7

人多不管用!智能体团队别盲目扩张,最新综述给出三维度

随着语言模型驱动的多智能体系统快速发展,核心问题是有些系统规模后会失稳、低效。美国、英国和澳利亚研究人员提出三维分类框架描述规模智能体网络,指出真正决定系统表现的是三种机制组合。

新智元
算法论文8

中科 × 华为联合突破!SparseRM:1% 参数实现 LLM 偏好建模高效革新

中科与华为联合提出SparseRM轻量级偏好建模方案,基于稀疏自编码器构建低参可解释奖励模型。实验显示它用不到1%可训练参数,在多任务中性能优,还能融入下游对齐流程,为LLM高效对齐提供新可能。

深度学习自然语言处理
新闻资讯7

GPT-5.5好到不敢睡觉,奥特曼连夜写下五宣言!

GPT-5.5代号「Spud」,在多项测试中表现出色,开发者实测反馈良好。奥特曼在GPT-5.5发布且口碑好时,写下AI五原则,称AI要民主化、赋能等,还暗示政府需考虑新经济模式应对AI影响。

新智元
算法论文8

TRM思考奖励模型上线,模型推理质量终于能量化了 | ICML‘26 Oral

模型推理评测多只看答案,忽略推理过程。上海多校团队提出TRM,用ME² principle刻画推理质量,DAG-based pairwise evaluation还原结构,训练奖励模型,让推理质量可度量、训练和优化。

量子位
开源动态8

小米MiMo-V2-Flash开源:3090亿参数模型能否改写AI行业规则!

2025年12月16日小米开源旗舰模型MiMo - V2 - Flash,参数3090亿。它有独创‘按需激活’机制,推理成本低。采用MIT协议,价格亲民,构建全栈开源矩阵,在编程、长文本处理等领域表现出色。

MCP Server
开源动态8

全流程国产GPU,上下文提速100倍!中国科学院发布「线性复杂度」类脑模型

中国科学院自动化所李国齐、徐波团队发布国产自主可控类脑脉冲模型SpikingBrain-1.0,训练推理全用国产GPU。它具线性复杂度,超长序列处理速度快,还开源7B模型,为类脑智能发展提供新思路。

新智元