大V」共找到 5426 篇相关文章

新闻资讯7

LeapEMU生态计划启动:共筑RISC-V软件新生态

9月19日,“RISC-V软件生态研讨会”在珠海举办,会上发布全球首款支持超128核RISC-V RVA23企业级模拟平台LeapEMU及其生态建设计划,提出“两个目标、一个循环”理念,规划三阶段建设路径。

芯师爷
新闻资讯7

DeepSeek、GPT、Qwen,所有模型架构图都有,Karpathy:宝藏画廊!

模型赛道热闹,架构创新多,理解困难且缺清晰架构图。AI 研究者 Sebastian Raschka 绘制主流模型结构,整理成在线图谱「LLM Architecture Gallery」,方便研究者查阅对比。

机器之心
算法论文8

启发学习:让模型认知从外化到内生

当下模型能力多靠人为框架,能力上限受限。文章提出“启发学习”,将其集成到推理侧成Isaac框架,通过Prompt与网络层注入复用旧经验,实验显示能幅提升模型任务性能。

机器之心
开源动态8

DeepSeek-V3.1震撼发布,全球开源编程登顶!R1/V3首度合体,训练量暴增10倍

DeepSeek正式上线DeepSeek-V3.1,作为首款「混合推理」模型,将开启智能体新时代。它参数共671B,具强智能体能力,编程击败Claude 4,训练量幅扩增,在多方面测试表现出色,稳坐编程开源第一王座。

新智元
新闻资讯8

模型竞赛转向:决胜关键为何是“后训练”?

模型价值主战场正向后训练转移。xAI发布的Grok 4通过后训练取得强性能,在多项测试中领先。后训练可解决通用模型产业落地难题,不同公司探索新方法,且后训练有五关键要素,阿里云提供一体化支撑。

InfoQ
产品应用7

The Batch: 978 | DeepSeek-V4-Pro 更新了

DeepSeek发布旗舰模型DeepSeek-V4-Pro-0813正式版,性能提升,还发布开源agent harness开发者预览版并提价。模型在多指标表现佳,编码能力改进明显,公司公开基准测试框架意义

DeeplearningAI
开源动态7

国产开源模型:再见9月,你好10月~

9月国产模型持续开源,涉及DeepSeek、Qwen、百度等。如DeepSeek-V3.1缓解语言问题、优化Agent能力;阿里Qwen系列开源超10个模型;百度Qianfan-VL增强领域能力等。还展望10月新模型开源。

PaperAgent
开源动态8

AI操作网页:browser-use和AI模型互动解析

文章深入解析开源框架browser - use与AI模型互动方式。它能自动化在线任务,靠精巧prompt设计和不同类型Message输入实现高效交互,还总结出可用于其他模型交互场景的技巧。

阿里云开发者
新闻资讯8

梁文锋,Nature全球年度十科学人物!

权威科学期刊《自然》公布2025年度十科学人物榜单,梁文锋因DeepSeek模型对AI领域的重要贡献与变革性影响成功当选。此外,中国研究员杜梦然也因相关研究入选,还有多位其他领域人物因各自成就上榜。

量子位
产品应用8

融合风控知识的模型体系建设与应用实践

腾讯算法专家欧阳天雄在AICon会分享《模型驱动下的智能风控落地实践》,介绍腾讯天御融合海量风控知识构建金融风控模型,解决传统风控模型难题,还展示构建技术、工程实践及落地案例,为金融风控提供新思路。

InfoQ