上科大」共找到 6378 篇相关文章

产品应用8

英伟达帮你省钱,让模型推理「短而精」,速度快5倍

过去模型推理追求长链思维,导致推理链长、Token消耗、响应慢。英伟达研究院的DLER研究给出解决办法,通过强化学习优化方法让模型‘短而精’,推理长度减超70%且准确率不变,还适用于模型。

机器之心
推荐文章7

LLM遇表格:4类表示、5任务、3机会

文章指出LLM处理表格有任务单一、输入复杂易崩、表示不统一痛点,介绍4种表格输入表示法、5任务,还发现任务复杂度、输入复杂度及表示统一方面存在新研究机会。

PaperAgent
推荐文章8

小白也能看懂,一文彻底说清 MCP、A2A与AG-UI,模型应用集成协议三件套。

文章面向有一定技术基础但不熟悉模型应用开发的读者,通俗介绍MCP、A2A和AG - UI三主流集成协议,分别解决不同的集成难题,三者构成模型应用集成完整生态。

AI大模型应用实践
8

12月首炸!可灵 O1 正式发布,全球首个统一多模态视频模型,强得可怕!

12月快手旗下可灵发布全球首个统一多模态视频模型Kling O1,标志AI视频进入“全流程语义控制时代”。它将多种视频创作能力统一,有全能引擎等五亮点,性能对比优势明显,让AI视频生成更可控。

开源星探
算法论文8

DeepSeek发布最新论文,5杀手锏让模型训练、推理暴涨

全球著名开源模型平台DeepSeek在huggingface发布超强开源模型V3的论文,从硬件架构和模型设计双视角探讨高效训练和推理,提出DeepSeek - MoE、多头潜在注意力等创新技术,解决内存、计算效率等难题。

AIGC开放社区
新闻资讯8

惊天瓜!中东土豪发「纯血」模型,背后底座竟是MiniMax?

沙特发布号称100%沙特血统的国家级模型HUMAIN M3,后被发现基于中国MiniMax的M3模型。沙特用超1万亿阿拉伯语Tokens后训练,使模型在阿拉伯语赛道领先,代表中国AI出海新形态。

新智元
推荐文章7

为什么堆算力救不了模型

文章指出模型和人类脑归纳规律路径不同,AI追求精确但脆弱的拟合,人追求粗糙但不变的压缩。模型在可收敛系统表现惊艳,不可收敛系统则崩盘,未来AI产品核心是打造可收敛封闭环境。

AI科技评论
新闻资讯8

云栖重磅合集 | 吴泳铭:超级人工智能之路

2025云栖,阿里巴巴集团CEO吴泳铭认为实现AGI是确定事件,终极目标是超级人工智能ASI。他介绍了通往ASI的三阶段,还判断模型是下一代操作系统,超级AI云是下一代计算机。阿里云也升级全栈AI体系,通义模型7连发。

阿里云开发者
开源动态8

nanobot4,000行代码复刻Clawdbot

nanobot用4000行代码复刻Clawdbot,解决AI从‘被动回答’到‘主动服务’问题。它有核心架构Agent Loop,三主动触发机制,模块化设计,还坚持少即是多原则,让AI成自动化助手。

CourseAI
推荐文章7

人才济济的厂,为何频频产出垃圾代码?

厂常产出垃圾代码,原因在于多数代码变更由菜鸟工程师完成,他们经验不足且常处于摸索状态。老手虽有优势,但过度依赖有问题。厂为调度人才牺牲代码质量,这在AI时代隐患更

InfoQ