大模型数据」共找到 10150 篇相关文章

推荐文章8

谁在赚钱,谁爱花钱,谁是草台班子,2025 年度最全面的 AI 报告

Nathan Benaich发布《State of AI Report(2025)》,如AI全景地图,覆盖研究、行业等领域。2025年AI业务赶上炒作,模型竞争激烈,开源、智能体等发展显著,还对未来一年AI发展作出预测。

Founder Park
开源动态8

特斯拉开源硬件,中国公司回应来了:直接把机器人脑开源了

特斯拉开源硬件专利后,智平方于4月22日发布AlphaBrain Platform开源社区,拿出含具身前沿技术等的“顶配全家桶”。介绍了世界模型、RL Token等5技术亮点,还说明其用途及智平方过往开源成果与公司实力。

量子位
算法论文8

清华刘知远团队论文:最小化结构改动,短文本到长文本丝滑升级 | ICLR 2026

语言模型发展中,上下文长度成关键瓶颈,主流架构计算开销。清华刘知远团队提出《InfLLM-V2: Dense-Sparse Switchable Attention for Seamless Short-to-Long Adaptation》,提出可切换注意力框架,为长上下文研究提供新思路。

AI科技评论
新闻资讯7

Anthropic逃过一劫:成功和解万亿美元版权诉讼,避免破产

Anthropic与作者达成和解,避开12月审判和可能高达万亿的赔偿。此前法官裁定其用盗版内容训练模型属盗版行为。和解为行业划红线,数据需明确来源授权,Anthropic仍面临其他版权挑战。

AGI Hunt
新闻资讯8

斯坦福临床医疗AI横评,DeepSeek把谷歌OpenAI都秒了

斯坦福最新模型医疗任务评测,构建含35个基准测试的MedHELM综合评估框架。结果显示,DeepSeek R1以66%胜率领先,o3 - mini等模型也各有表现,还分析了成本效益。

量子位
算法论文8

刚刚,DeepSeek首曝V3降成本秘诀!软硬协同突破Scaling天花板

DeepSeek最新论文从硬件架构和模型设计双重视角,探讨如何相互配合实现低成本规模训练和推理,分析硬件特性对架构选择的影响,研究两者相互依赖关系,还为未来协同设计提出建议。

新智元
推荐文章9

Jev火了,但真正重要的不是Jev | 5Y View

TypeSafe AI发布专用决策模型Jev后引发开发者社区关注,本文跳出Jev本身讨论,重新审视模型通用生成的默认前提,提出AI计算专用化与任务分工的核心观点,预判AI行业发展趋势。

五源资本 5Y Capital
产品应用7

人形机器人终于学会洗碗了

Figure机器人学会洗碗,用的是叠毛巾和分包裹同款Helix架构,无新算法和特殊工程,仅增加新数据。该架构是端到端“视觉 - 语言 - 动作”模型,同一系统增数据就能学新技能。

量子位
新闻资讯7

Meta出走华人创业团队,种子轮800万美元,要打造视觉AI记忆

由前Meta顶尖科学家创立的Memories.ai获800万美元种子轮融资。其视觉记忆模型LVMM解决AI‘记忆缺失’问题,在多领域刷新SOTA基准,应用潜力,还开放API及网页应用。

机器之心
产品应用8

阿里又放招!一句话,造一个能走进去的世界

阿里上线HappyOyster 1.0世界模型,一句话生成可实时探索、交互的开放世界。它与文生视频不同,能让用户参与体验。该模型有世界探索和实时导演两功能,技术优势显著,应用场景广泛。

新智元