AI 大模型」共找到 13957 篇相关文章

产品应用8

只用国产GPU训练的模型性能飙升100%!国内唯一,更懂你

讯飞发布全国产算力训练的讯飞星火X1.5,推理效率暴涨100%,综合性能跻身全球顶级。还首发非自回归语音模型架构,效果提升、成本降低。此外,展示多领域应用成果,发布相关产品,开源智能体平台。

新智元
新闻资讯8

中国团队首次在Nature子刊发布医疗AI标准,未来医生MedGPT摘得全球桂冠

中国AI医疗公司“未来医生”协同专家制定CSEDB,首次提出评估医疗模型临床能力的系统性框架,被《npj Digital Medicine》收录。在其评估下,未来医生的MedGPT在主流模型中夺冠。

量子位
算法论文8

模型自己写代码、自己进化,GIM和港这篇ACL主会,把量化因子挖掘重做了一遍

香港学和GIM提出CogAlpha框架,将Alpha从‘公式’升级为‘代码’,搭建7层21个智能体探索体系,让模型参与研究流程。在5个数据集上跑赢21个基线方法,还具可解释性。

机器之心
产品应用8

人物一致性新王Nano Banana登基,AI图片编辑史诗级升级。

Nano Banana是神秘的AI绘图新模型概率出自Google。它生图一致性超强,在人物一致性、背景替换等多方面测评中完胜GPT - 4o等模型。虽仅在LMArena盲测随机出现,仍值得一试。

数字生命卡兹克
新闻资讯7

DeepSeek新模型意外曝光:AI Agent才是未来~

据彭博社消息,中国AI新星DeepSeek计划年底发布对标OpenAIAI Agent,能自主执行多步任务、自我学习进化。国内Kimi、Qwen也有相关动作,还分享了72多种高效AI工具。

PaperAgent
算法论文8

拒绝“熵崩塌”和“熵爆炸”!这项研究让模型学会“精确探索”,推理成绩飙升

2024年以来,模型在推理任务上进展显著,得益于RLVR方法,但面临“熵困境”。研究团队提出选择性熵正则化方法(SIREN),通过三重机制精准调控探索行为,实验证明其能提升模型推理成绩。

量子位
算法论文8

迎接范式革命:最新、最全的模型Latent Space综述,NUS、复旦、清华等联合出品

模型核心计算正从显式空间转向潜在空间,现有文献缺乏统一视角。NUS、复旦等机构的综述《The Latent Space》从五视角构建框架,阐述潜在空间基础、演进、机制、能力,指出挑战与未来方向。

机器之心
算法论文8

缺数据也能拿SOTA?清华&上海AI Lab破解机器人RL两瓶颈

现有机器人视觉 - 语言 - 动作(VLA)模型训练范式存在数据采集成本高、泛化能力不足等问题。清华和上海AI Lab团队提出SimpleVLA-RL,解决了VLA模型训练的核心瓶颈,在多基准测试中实现SoTA性能。

量子位
新闻资讯7

BigQuery 新功能:SQL 直调 17 万 + AI 模型,3800 万行数据处理成本仅 2 美元

Google为BigQuery推出面向开源模型的第三方生成式AI推理功能,允许数据团队用SQL语句部署运行Hugging Face或Vertex AI Model Garden的模型,消除对独立ML基础设施的需求,解决数据团队痛点。

InfoQ
新闻资讯7

一人公司火了,但Chatbot不是最机会 | 不是 for 人,而是 for Agent 。

在2026中关村论坛上,天工AI发布三核心模型,公布昆仑万维AGI战略。天工AI董事长周亚辉在对话中谈中国模型竞争力、企业出海、产品价格等问题,认为企业级Agent是更金矿。

AI进修生