设计模式」共找到 2120 篇相关文章

新闻资讯8

“为了一个功能,需要再造一个Google!”Jeff Dean最新对话:TPU的诞生,与那些差点把服务器烧了的疯狂往事

在Google Cloud Next上,Jeff Dean和Amin Vahdat分享了Google算力帝国崛起秘史。从TPU诞生背景,到自研硬件血泪史,再到软硬件协同设计,还探讨了AI未来瓶颈,如能源、硬件等,以及代码编写现状。

AI科技大本营
推荐文章7

通过架构建议流程实现架构决策的去中心化

Andrew Harmel - Law 在 Goto 大会提出架构建议流程,认为传统架构实践不可扩展,架构需去中心化。该流程让任何人可做决策,只需向受影响者和专家寻求建议,还提到失效模式及实践转变。

InfoQ
产品应用8

AI视频生成走向“演技生成”时代,生数科技Vidu全球发布Vidu Q2 | 甲子光年

9月25日,生数科技全球上线新一代图生视频大模型Vidu Q2,实现从“视频生成”到“演技生成”跨越。它在表情生成、运镜、语义理解、时长选择等方面有提升,分闪电和大片模式,已在多端上线。

甲子光年
算法论文8

X-SAM:从「分割一切」到「任意分割」:统一图像分割多模态大模型,在20+个图像分割数据集上均达SoTA

中山大学、鹏城实验室、美团联合提出X - SAM,统一图像分割多模态大模型。它将分割范式扩展,设计通用输入输出,采用端到端架构和三阶段训练策略,在超20个数据集达最优,为图像分割研究开辟新方向。

机器之心
产品应用7

这样更公平:用jina-reranker-m0为多模态文档打分重排

文章指出多模态搜索领域给文档综合评分难,因文本与图像评分缺乏可比性。2025年4月发布的jina - reranker - m0可解决此问题,其两阶段检索流程能显著提升召回率,对多模态AI系统设计有启发。

Jina AI
新闻资讯7

人类秒懂,AI崩溃:一个简单测试,就让GPT-5、Gemini等顶级模型集体“翻车”

来自多机构研究团队发现,OpenAI的GPT-5等顶级AI模型,面对‘看得见但读不懂’文字时表现极差。VYU团队实验显示,人类能轻松读懂的切分拼接文字,AI却全军覆没,原因是其靠模式匹配,不懂文字结构。

量子位
算法论文8

一键实现PPT演讲自由!「解说音频+视频」同步生成,效果逼近真人

澳大利亚与英国研究人员提出文档到演示视频生成任务,推出PresentAgent系统。它能将长文档转为带语音和同步幻灯片的视频,流程可控且适应多领域。实验显示其生成视频接近人类表现,还设计了双路径评估策略。

新智元
推荐文章8

卡帕西点赞Transformer内置计算机!每秒3万Token吞吐,拿下世界最难数独

当前大模型推理顶尖但精确计算不足,Percepta团队在Transformer权重里内嵌可执行程序,通过2维注意力头设计提升推理效率,能在普通CPU上实现每秒3万+Token的流式输出,还精确求解了世界最难数独。

量子位
开源动态8

GitHub Trending 榜一的开源 Cowork 来了!4天4.5K星,首个多智能体工作流应用!

开源项目Eigent冲上GitHub Trending榜首,4天获4.5K+ Star。它是全球首个多智能体工作流桌面应用,完全开源、支持本地模型,有多种智能体工作流,具备本地优先、并行工作流等特性,提供三种使用模式

开源星探
产品应用7

又又又进化了!Clawdbot可以在ClawTasks打工赚钱了

Clawd生态再进化,Clawdbot能在ClawTasks平台打工赚钱。该平台让AI智能体相互雇佣并用USDC交易,支持三种悬赏模式。目前已有多个智能体活跃,此外Virtuals Protocol宣布相关协议支持OpenClaw智能体。

AI工程化