成本性能」共找到 6938 篇相关文章

新闻资讯8

智源发布 2026 十大 AI 技术趋势:世界模型 AGI 共识方向

2026年1月8日,智源研究院发布《2026十大AI技术趋势》,指出AI演进核心从语言学习转向理解物理世界秩序。报告阐述了AI从数字迈向物理世界的三条驱动主线,并给出十大趋势,为行业提供布局锚点。

AI前线
算法论文7

穷人福音!MIT研究:不用堆显卡,抄顶级模型作业就

MIT研究把59个不同模型凑一起,发现强大模型对物质理解趋同,且性越强思维越接近。研究还指出性不佳模型的问题,认为可通过模型蒸馏让小模型模仿大模型,实现算力自由。

新智元
开源动态8

个人电脑也进行智体RL训练?尤佳轩团队开源OpenTinker

伊利诺伊大学厄巴纳 - 香槟分校尤佳轩团队开源OpenTinker,这是全新‘强化学习即服务’系统。它通过解耦架构和友好API,让开发者在不同算力设备启动智体训练,解决传统RL框架难题,指明下一代智体基建方向。

机器之心
7

看懂这篇,你就秒懂 LLM底层秘密—Transformer原理解析

文章由浅入深介绍LLM基础知识,着重解析Transformer原理,结合案例讲解其工作流程,还介绍当前开源旗舰LLM架构变化,如DeepSeek V3等模型的创新,最后强调模型力与应用形态的关系。

腾讯技术工程
新闻资讯7

谷歌训出Gemini 3的TPU,已老黄心腹大患!Meta已倒戈

谷歌酝酿TPU@Premises计划,允许客户将TPU搬进自家数据中心,首个目标是Meta。谷歌Ironwood TPU v7与英伟达B200性相当,还拥抱PyTorch拆解CUDA壁垒,欲夺英伟达10%市场份额。

新智元
推荐文章7

舍弃 VAE,预训练语义编码器让 Diffusion 走得更远吗?

纽约大学谢赛宁团队、清华&快手 Kling 团队的研究者指出 VAE 制约当前 Diffusion 范式,提出用预训练视觉模型作语义编码器改进。介绍了 VAE 不足及 RAE、SVG 工作如何解决问题,将扩散模型从‘压缩优先’转为‘语义优先’。

机器之心
新闻资讯7

前OpenAI研究员跨界做文创:Ilya发型帽子走红,AI潮牌!

前OpenAI研究员Karina Nguyen创立时尚品牌Maison AGI,首个系列与Ilya Sutskever合作,推出以其头型为原型的帽子。她称这或是人类被AI超越前最后一次手作,AI故事正从技术革命变为文化遗产。

新智元
新闻资讯7

新榜单CompileBench:让AI搞定22年前的老代码

近日,CompileBench 测试 19 个 AI 模型编译真实代码力,最难任务是复活 2003 年代码并交叉编译到 Windows 和 ARM64。不同模型表现不同,如 Claude Opus 4.1 功完 ARM64 静态编译,各模型有不同优缺点。

AI工程化
8

“智元机器人收购A股上市公司是创新需要…现金流撑三年”

智元机器人收购A股上纬新材后公开亮相,董事长邓泰华透露融资、出货等规划。其团队高管回应收购舆论、技术果及合作等问题,如远征A2高温行走突破、与上市公司合作原因等,还提及出海和工业场景ROI规划。

量子位
开源动态8

手机也跑,腾讯混元一口气开源4款小模型

腾讯混元团队开源4款小模型,最大7B。可在低功耗场景运行,支持微调。是融合推理模型,有快、慢思考模式,在多领域表现出色,亮点是agent和长文力,已落地多元业务场景。

机器之心