「在离线混部」共找到 8196 篇相关文章
GPT-5超越人类医生!推理能力比专家高出24%,理解力强29%
最新研究显示,GPT - 5在医疗领域处理多模态信息能力出色,在多模态测试中推理和理解得分比GPT - 4o分别提高近30%和36%,比人类医生还高。其能力提升源于端到端多模态架构,但现实应用还需更多实战考验。
太初元碁乔梁:AI算法已经跑到单芯片极限|MEET2026
在量子位MEET2026智能未来大会上,太初元碁乔梁表示,当下AI算力需求指数级增长,超智融合成行业共识。单颗芯片性能成瓶颈,太初元碁设计PC link实现芯片互联,还分享了HPC+AI在多领域的落地实践。
告别App孤岛,天翼AI如何用统一入口重构数亿用户的数字生活?|甲子光年
2025年中国AI行业模型能力强但用户体验复杂,存在数字鸿沟。中国电信在数智科技生态大会上,天翼AI发布星辰智能体服务平台1.0,以统一入口“星小辰”智能体重塑入口逻辑,还在多领域布局扩张能力。
OpenAI要跳过5.3,直接迈向GPT-5.4了?
近日,一名OpenAI工程师在公开的Codex GitHub仓库中提交拉取请求,让GPT - 5.4型号出现在代码版本判断条件中,同时有用户发现它曾短暂出现在Codex应用的模型选择器里。线索被迅速修改或删除,引发诸多猜测。
华为超树HTP:不写示例、不调PDDL,AI规划约束通过率飙升62.6%
文章介绍华为超树HTP,它是完全自主、可泛化的推理新范式。能让LLM在超树结构上完成规划,不依赖人工示例和外部规划器,在复杂规划benchmark上实现SOTA准确率并降低token成本,还阐述其原理、创新点及应用实例。
MSRA清北推出强化预训练!取代传统自监督,14B模型媲美32B
微软亚洲研究院联合清北提出全新预训练范式RPT,将强化学习融入预训练,把预训练语料库重构为推理问题集。实验显示RPT-14B表现出色,在多方面媲美甚至超越32B模型,未来RL或在LLM预训练掀起风暴。
4万星开源项目被指造假!MemGPT作者开撕Mem0:为营销随便造数据,净搞没有意义的测试!
高人气开源智能体记忆项目Mem0在论文中称在LOCOMO上打败所有人,MemGPT联合创始人公开指控其测试无意义、数据造假。二者都为解决大模型长期记忆问题,Letta认为能力比工具重要,并给出评估智能体记忆能力的方法。
人人可用、真能落地,阿里用Agent掀翻了数据分析的牌桌
文章介绍阿里全资子公司瓴羊升级“智能小 Q”,这是阿里在数据分析赛道的首份 Agent 答卷。分析了数据分析从可视化、可决策到可行动的三阶跃迁,阐述智能小 Q 在准确性、企业级能力、价值增量方面的表现及应用案例。
Dense、MoE之外第三条Scaling路径:交大提出JTok模块,省1/3算力
上海交通大学与小红书Hi Lab联合团队提出JTok/JTok - M模块,作为插件挂载在Transformer层,几乎不增算力和显存开销却显著提升性能。该模块构建新scaling路径,在多任务测试中全面提分,为大模型发展提供新方向。
高通祭出全球最快移动SoC!卢伟冰携全球首发小米17Pro现身
2025骁龙峰会·中国会场,高通推出第五代骁龙8至尊版移动平台,采用台积电3nm制程。小米17系列将全球首发,多家厂商也会搭载。该芯片在CPU、GPU、NPU等多维度性能提升,还在影像、音频和通信方面有飞跃。