大厂自研」共找到 5930 篇相关文章

新闻资讯7

英伟达Thor芯片屡屡延期:车企被迫转身,供应链迎来机遇

英伟达原计划的Thor芯片因架构和设计缺陷多次跳票,性能幅缩水至约700TOPS,打乱国产车企规划,小鹏、理想等商回调旧方案或加速研。同时,也为国产芯片企业带来机遇,推动市场走向多元竞争。

芯师爷
推荐文章8

从混沌到可控:企业应用中AI Agent不确定性控制的 10 种策略

语言模型输出的不确定性限制了AI智能体在企业场景的应用,本文总结控制生成式AI Agent不确定性的常见策略,涉及技术、应用设计、管理与治理层面,还推荐了相关作品。

AI大模型应用实践
开源动态8

社区供稿 | 阿里国际Ovis2.5重磅发布:以小博,刷新开源模型性能新高度

阿里国际发布多模态模型Ovis2.5,在OpenCompass综合得分提升,保持SOTA水平。它在原生分辨率视觉感知等三方面突破,有9B和2B两版本,代码、模型等资源已开源,技术原理涉及架构、训练与数据。

Hugging Face
新闻资讯8

百度:和家一起讲 「超级有用」的故事

作者参加百度AI DAY智能云创新行业专场,看到百度全栈AI解决方案矩阵及应用案例。百度通过构建生态、全栈研、推动科技平权等举措发力AI,诸多应用已取得商业成果,有望在AI商业化长跑中胜出。

MacTalk
开源动态7

野生DeepSeek火了,速度碾压官方版,权重开源

近日,德国AI咨询公司TNG推出的「DeepSeek R1T2」模型火了,速度比R1快20%,性能不弱于R1。它采用AoE技术,融合官方三模型,开源且在Hugging Face开放权重,获不少人期待。

机器之心
7

强化学习之父:LLM主导只是暂时,扩展计算才是正解

新晋图灵奖得主、强化学习之父Richard Sutton在新加坡国立学演讲时预测,模型主导是暂时的,未来五年甚至十年内不是技术前沿。他认为AI应从依赖人类数据转向体验学习,强化学习潜力需靠扩展计算支撑。

量子位
新闻资讯7

苹果拆解AI脑,推理模型全是「装」的?Bengio兄弟合著

苹果最新研究揭示推理模型(LRM)在高复杂度任务中普遍‘推理崩溃’。即便给予明确算法提示,模型亦无法稳定执行,暴露推理机制的局限性。研究还通过多种实验环境分析了模型在不同复杂度问题中的表现。

新智元
新闻资讯7

人形机器人开始打国球了!两台机器人完整打完11分制比赛

第二届世界人形机器人运动会8月22 - 26日将在「冰丝带」举行,港超维战队的两台人形机器人按11分制主打完一局。其采用主研发的SMASH 2.0系统,团队还探讨技术难点、系统升级等问题。

量子位
新闻资讯7

Mistral 为 Le Chat 新增远程智能体与 Work 模式

Mistral发布1280亿参数的Mistral Medium 3.5模型,在Vibe和Le Chat引入云端智能体能力,还在Le Chat新增Work模式。新模型可托管,支持长上下文窗口。社区反馈积极,开发者认可,也有人嫌定价贵。

InfoQ
产品应用8

揭秘超节点,AI算力需要“统一的语言”

AI模型热潮带动算力行业发展,中国AI芯片崛起,但单颗芯片算力不足、不同设备沟通有障碍成行业难题。华为发布“超节点”架构与“灵衢”技术,搞出“算力普通话”,目标是让算力系统更高效、灵活、省钱。

芯师爷