设计与代码」共找到 8306 篇相关文章

算法论文8

Stanford、Meta和Google等发现LLM存在五大天花板,再扩算力已无用

论文《On the Fundamental Limits of LLMs at Scale》指出,LLM性能提升有理论天花板,扩展中会遇幻觉、上下文压缩等五大根本限制,源于计算、信息学习理论,未来应转向‘有限优化’。

深度学习自然语言处理
产品应用7

Vibe Coding 继续:这次,AI Studio 让你可以“画着改UI”

谷歌在AI Studio中引入注释模式,可乱涂乱画用注释命令修改,能更自然地更改应用,Gemini进行直观视觉对话,还提到Cursor等IDE中类似功能实现方式。

AI进修生
产品应用8

松下发布多模态大模型,文本、图像、音频随意切换

多模态数据处理成热点,但现有模型处理复杂任务有挑战。松下开发多模态大模型OmniFlow,采用模块化设计、多模态引导机制,实验显示其在多任务中有卓越表现。

AIGC开放社区
推荐文章7

windsurf分享了他们对构建Agent应用的认知。

windsurf发表博客讨论Agent,指出构建Agent应用存在认知误区,分享灵魂四问分析框架评估其‘含金量’,还提到苦涩教训,提醒警惕过度设计,拥抱规模化、通用化方法。

探索AGI
开源动态8

视频生成比播放还快:开源VDN-H3,14秒视频11秒搞定

近期,网络出现“无限流”视频,源于MiniMax H3。OpenVDN团队开源Video Delta Net(VDN),基于MiniMax H3使视频生成速度提升75到90倍,14.4秒的768p视频11.23秒就能生成。它采用混合思路,性能提升显著。

AI工程化
新闻资讯7

The Batch: 906 | AI 巨头分担维基百科的成本

维基百科成立25周年,维基媒体基金会Amazon、Meta等多家AI公司达成合作,推出Wikimedia Enterprise计划,允许合作方高速大规模访问数据。维基百科需资金支持,AI公司也需其数据训练模型。

DeeplearningAI
开源动态7

R1一周年,DeepSeek Model 1悄然现身

2025年1月20日,DeepSeek发布DeepSeek - R1开启新开源LLM时代,其在Hugging Face获赞最多。一年后,DeepSeek新模型Model1在GitHub现身,经Gemini分析或为DeepSeek - V4,还给出相关技术细节。

机器之心
新闻资讯7

语言模型内部还藏着众多策略模型?自底向上强化学习重塑底层特征 | 直播预约

现有强化学习工作将语言模型作整体策略优化,研究提出以策略视角审视内部隐藏状态,分析层级和模块级策略,发现不同模型模式差异,还提出自底向上强化学习策略,为研究架起新桥梁。

深度学习自然语言处理
新闻资讯8

黄仁勋GTC2026:龙虾是个人AI操作系统,每个企业都要围绕它来建设,2027营收有望突破1万亿美金

英伟达GTC2026发布会结束,黄仁勋将2027年前需求预测提至1万亿美元。会上发布多项技术产品,如开源AI智能体框架NemoClaw、太空数据中心Space - 1等,还提及自动驾驶合作进展。

AI寒武纪
新闻资讯7

受够了Copilot的“霸王条款”?GitHub全球宕机遭怒骂,引爆开发者“大逃离”!

GitHub 大面积宕机,引发开发者抱怨,虽已恢复服务,但未公布故障原因,不少人怀疑 Copilot 有关。同时,Gentoo Linux 因 Copilot 强制启用争议计划迁仓,个人开发者也有逃离意向。

AI前线