新全栈」共找到 5133 篇相关文章

推荐文章8

还在拼命加 GPU?AI 应用规模化的下半场,拼的是这五大软件“基建”

文章指出 AI 应用规模化下半场,拼的是五大软件“基建”。从云原生到 AI 原生,应用基础设施面临诸多挑战,如从代码中心到智能体管理等。作者提出构建智能体协作网格、认知记忆平台等五座技术灯塔,助力 AI 原生应用发展。

InfoQ
算法论文8

别再用单选评测骗自己了!Amazon论文揭示了大模型在多选题中的3种系统性偏差

Amazon论文揭示大模型做多选题有3种系统性偏差,如选择、数量、猜测偏差。还推出SATA - Bench评测,给出10个测量指标,提出Choice Funnel解码策略,能提升小模型多选题正确率。

深度学习自然语言处理
新闻资讯7

英伟达放弃GPU上LPU:推理芯片被曝Groq即买即用,OpenAI第一个吃螃蟹

英伟达将在GTC大会发布AI推理系统,核心芯片基于Groq的LPU架构,首位大客户是OpenAI。选择外部架构与时间窗口有关,推理场景中LPU更适配。同时,英伟达推理芯片面临诸多威胁。

量子位
新闻资讯8

13年死磕一个真理,这家中国AI黑马冲刺IPO

云知声深耕AI 13年,即将冲刺港交所IPO。它从单一语音识别发展为AGI方案商,以智慧生活和智能医疗双轮驱动,营收稳健增长。其坚持技术创,构建自研体系,有望在AI时代持续领跑。

新智元
算法论文8

GUI智能体训练迎来范式!半在线强化学习让7B模型媲美GPT-4o

浙江大学与通义实验室团队推出UI - S1,提出半在线强化学习训练范式。它融合离线与在线学习优势,用三项关键技术构建核心架构,评测指标SOP更贴近真实表现,实验显示UI - S1 - 7B性能卓越,逼近GPT - 4o。

量子位
新闻资讯7

智谱 GLM-4.5 团队深夜爆料:上下文要扩、小模型在路上,还承诺尽快发模型!

今日凌晨,GLM系列模型四位研发成员在Reddit的AMA活动中,回答了GLM系列技术细节、未来规划等问题。透露扩展上下文、推小模型是重点,还承诺尽快发模型,也探讨了大模型发展观点。

AI前线
新闻资讯8

80%美国AI初创靠中国开源模型“吃饭”!a16z投资人震惊,球开源榜前16名被中国包揽

Reddit上“中国开源AI模型席卷美国初创”帖子爆火。a16z合伙人Martin Casado称80%美国AI初创融资路演用中国开源模型。Design Arena榜单前16名开源模型是中国的,中国开源模型优势尽显。

InfoQ
算法论文8

Qwen&清华团队颠覆常识:大模型强化学习仅用20%关键token,比用部token训练还好

Qwen与清华LeapLab团队研究发现,大模型强化学习训练推理能力时,仅20%高熵token就能撑起效果,甚至超部token训练。团队用此在Qwen3-32B创造SOTA记录,还探讨了强化学习的相关特性。

量子位
开源动态7

一周斩获8k星!港大开源AI学习助手,学练研流程覆盖,教师也要失业了?

港大开源的DeepTutor是AI个性化学习助手,利用多智能体协作等技术,有文档问答、难题解析等四大核心功能,能构建专属知识库,提供流程辅导,为学、练、研打造一体化平台。

开源AI项目落地
开源动态8

万亿思考模型速度!蚂蚁开源Ring-2.5-1T:IMO金牌水平,强;混合线性架构,快!

蚂蚁集团发布球首个开源混合线性架构万亿参数模型Ring - 2.5 - 1T,打破深度思考牺牲推理速度和显存的‘不可能三角’。还同期发布扩散语言模型LLaDA2.1和模态大模型Ming - flash - omni - 2.0,想做成可复用底座。

量子位