多平台架构」共找到 6216 篇相关文章

产品应用8

基于阿里云 AgentLoop 的 DeepSeek Harness 评测实践

本文分享基于阿里云 AgentLoop 平台的 DeepSeek Harness 评测实践。介绍了 DeepSeek Harness 工程架构,阐述 AgentLoop 平台接入方式及价值,还详述评估器设计思路、展示评测结果,最后总结方法论并展望后续工作。

阿里云开发者
新闻资讯7

HF Papers 直播 AI Insight Talk| Omni全模态专场

平台联合发起的【AI Insight Talk】系列直播活动第五场 - Omni全模态大模型专场于2025年11月18日10:00 - 12:00直播。位全模态模型核心研发者将分享技术,还有圆桌对谈。

Hugging Face
推荐文章7

在 AI 时代构建 MVP

文章围绕AI在构建最小可行产品(MVP)中的作用展开。它能在理解QARs、推动架构决策等方面提供帮助,如提出被忽略的需求、缩小技术搜索范围等,但不能完全替代人类做决策。

InfoQ
算法论文8

停止迷信“超级Prompt”:要想AI不犯错,你得专门雇人“怼”它

这篇来自Isotopes AI的论文指出,在生成式AI落地中,迷信‘超级Prompt’不可取。对于高风险场景,单体LLM有局限,论文构建‘AI Office’架构,引入‘对手团队’概念,实验使准确率从60%提升到92.1%,但也有成本和局限。

深度学习自然语言处理
产品应用7

DeepSeekHarness被骂自嗨,还是Agent界Android?

DeepSeek Harness 评论两极分化,有人赞其为‘Agent 界的 Android’,也有人批其‘自嗨’。若将其视为 Agent Runtime 架构实验,它值得拆解。它以‘一切皆插件’理念设计,有诸独特架构特点。

CourseAI
新闻资讯8

刚刚Gemini上新模型,全球只有7人比它会编程,谷歌姚顺宇参与

北京时间周五凌晨,谷歌发布Gemini 3 Deep Think重大升级,在学术基准测试中取得佳绩,成本大幅降低,编程能力超数人。在科学领域表现出色,还推动了实际应用,已上线供部分用户使用。

机器之心
推荐文章7

《AI时代下,中国低/零代码市场发展研究》报告正式发布 | LowCode低码时代

《AI时代下,中国低/零代码市场发展研究》报告发布,指出低/零代码技术渗透率提升,主流厂商提供全链路方案。生成式AI与低/零代码融合成趋势,市场稳定增长,企业对平台综合能力要求提高。

AIGC开放社区
开源动态8

阿里Qwen又悄悄放出8个开源权重,卷疯了~

阿里通义千问太卷,悄悄放出8个开源模型权重,包括体积更小的Qwen3-VL及FP8权重。这一代实现全方位升级,提供两种架构、两个版本,架构也有更新,还给出使用示例与模型权重链接。

PaperAgent
算法论文8

重复一下提示词,Gemini准确率竟从21%飙升至97%!

Google Research团队研究发现,重复提示词可让Gemini准确率从21.33%升至97.33%。该策略能提升主流大模型非推理任务表现,在模型基准测试中优势明显,且不增加延迟。

AIGC开放社区
产品应用7

Pulsar特性在AI场景中的使用

随着AI发展,架构从单体到分布式演进,消息中间件成关键。Pulsar以存算分离等特性价值凸显,在模态训练、模型训练、智能体等AI场景有独特优势,如处理超大消息、实现断点续训等。

InfoQ