「技术能力」共找到 5592 篇相关文章

产品应用8

每2秒吃透一道高数大题!华为终于揭秘准万亿MoE昇腾训练系统全流程

华为揭秘准万亿MoE昇腾训练系统全流程,通过“昇腾+Pangu Ultra MoE”实现国产算力与模型自主可控训练闭环,从集群利用率、单节点算力、后训练技术三方面突破,实现大模型高效训练。

量子位
推荐文章7

Agent当道、模型封装一切:AI 时代的产研人如何不被“优化”?

随着 Agent 普及,技术复杂性被模型封装,产研人面临挑战。InfoQ 直播栏目邀请嘉宾探讨应对之策,还分享 AI 项目经验,分析 AI 编程痛点、落地案例,以及产品上线障碍和商业化方向。

InfoQ
新闻资讯8

谷歌 CEO 皮查伊万字专访:AI 正重塑搜索引擎、Web 乃至整个互联网

Google I/O 大会后,谷歌 CEO 皮查伊接受专访,围绕 AI 平台转型、搜索体验重塑等议题分享洞察。他指出 AI 是平台级跃迁,搜索将成定制体验,Web 在转型非消亡,还回应了新闻出版界不满等争议。

AI科技大本营
新闻资讯7

一个4000亿算力龙头将诞生?

海光信息与中科曙光联合宣布筹划重大资产重组,海光拟换股吸收合并中科曙光并募资。二者总市值超4000亿,此次并购有体量大、子并母、产业链纵向整合特点,或开启国内半导体并购潮。

芯师爷
算法论文8

模型越聪明越“不听话”?MathIF基准揭示AI服从性漏洞

上海人工智能实验室与香港中文大学研究团队发布论文,用MathIF基准揭示大模型“聪明”和“听话”有矛盾,越擅长推理越易忽略指令,还分析了原因并给出让模型更“听话”的方法。

深度学习自然语言处理
新闻资讯7

靠「AI婴儿播客」拿到a16z 3200万美元投资,Hedra凭什么?

Hedra是生成式AI创企,凭「AI婴儿播客」获关注,刚完成3200万美元A轮融资。它与主流AI视频平台路线不同,构建全模态基础模型,播客成杀手级应用,研发成本低,踩中赛道转型。

Founder Park
推荐文章8

北大校友、OpenAI前安全副总裁Lilian Weng关于模型的新思考:Why We Think

北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算研究进展,探讨激励模型思考方式,介绍思维链、并行采样、序列修订等策略,还提及强化学习、外部工具使用及未来研究方向。

Founder Park
开源动态7

字节开源DreamO,一个框架包揽多种图像定制需求

近期图像定制研究展示大规模生成模型潜力,但多数方法通用性有限。字节提出DreamO框架,支持多种图像定制任务,有特征路由约束机制,能解决特征冲突,还介绍其技术原理与各任务效果。

带你学AI
新闻资讯7

AI 开发工具的隐形战场:新一轮 IDE 之争打响!

在AI开发工具领域,VSCode成主战场,但背后有技术和策略拉扯。开发者面临战略选择,VSCode有诸多限制,OpenVSX虽提供替代方案但插件不全,Cursor崛起引发微软动作,未来走向待察。

AI科技大本营
开源动态8

公开模型一切,优于DeepSeek-R1,英伟达开源Llama-Nemotron家族

英伟达推出面向高效推理的 Llama-Nemotron 系列模型,包括 Nano、Super、Ultra 等规模,具备卓越推理能力与效率,采用开放许可。模型支持动态推理切换,训练结合多方法,性能优于 DeepSeek-R1 等。

机器之心