多 Agent」共找到 6079 篇相关文章

开源动态7

OpenAI解密大模型失控:它不是变坏,而是「太听话」

OpenAI公开IH - Challenge,解决大模型指令冲突难题。指出大模型问题因听信错误指令,给出系统>开发者>用户>工具的指令层级结构,设计数据集训练模型遵循高信任等级指令,提升安全可控性与抵御提示词注入能力。

新智元
新闻资讯7

比0.99元羊毛更重要的,是跟AI砍价的快乐

双11期间,不少人分享跟Kimi Agent会员砍价战果,原本49元/月的会员能砍到0.99元。作者尝试种砍价话术,如夸夸、卖惨等,还对比其他模型,最后总结出砍价秘诀,活动有时间和新老用户限制。

量子位
推荐文章7

如何让LLM的输出更有创造性和随机性?

文章指出让大模型生成随机创造性内容困难,介绍了调整温度和top_k参数等提升LLM创造性和随机性的方法,还提到min_p参数影响及外部引入随机性思路,不过LLM本质有局限,智能体或可缓解。

AI工程化
推荐文章8

NVIDIA技术沙龙 《大规模EP优化:PD分离MoE并行方式》课程笔记

本文是NVIDIA技术沙龙课程笔记,介绍大规模EP优化的PD分离MoE并行方式。涵盖PD分离、大规模专家并行等五项关键技术创新,还对比模型架构,展示推理服务架构性能特点与优化策略,以及各技术工作流程和效果。

GiantPandaLLM
算法论文8

博士学位答辩PPT分享 | 基于机器学习的复杂流场预测方法研究

左奎军博士论文聚焦基于机器学习的复杂流场预测,以种对象构建智能流场预测网络架构,发展耦合求解方法,剖析核心要素影响,提出个创新模型和策略,还分析了不同模型在流场预测中的表现与问题。

力学与人工智能
算法论文8

众所周知视频不能P?北大施柏鑫团队、贝式计算CVPR研究:视频里轻松换衣服、加柯基

视频编辑难度高,传统流程繁琐,现有AI方法有局限。北大施柏鑫团队联合贝式计算等提出VIRES方法,能实现视频主体种编辑操作,还标注VireSet数据集。其在指标超现有SOTA模型,团队还探索全景级可控视频生成。

机器之心
算法论文7

3D-R1重塑三维视觉语言推理!让三维交互更智能

近年来,视觉 - 语言模型在2D图像理解有突破,但3D视觉语言模型面对复杂场景不足。为此上海大学团队提出3D - R1模型,它基于新数据集和策略构建,有强任务三维理解能力,不过也存在进步空间。

带你学AI
新闻资讯7

Google 发布 Gemini 3.8 Flash:6 周内第 3 次升级

Google DeepMind 官宣发布 Gemini 3.8 Flash 和 3.8 Flash Cyber 两个新模型。3.8 Flash 在软件工程等方面有显著提升,跑分成绩亮眼,价格实惠,性价比高;3.8 Flash Cyber 面向网络安全场景。目前 3.8 Flash 已在平台上线。

AGI Hunt
产品应用7

混元 Hy3 发布:99% 的任务,够用了

腾讯混元模型 Hy3 正式上线,免费使用两周。它是快慢思考融合的 MoE 模型,主打 Coding 和 Agent 场景,性价比高。作者用它做了项测试,如制作 PPT、开发代码、舆情分析等,还与 GLM - 5.1 对决,表现不错。

AGI Hunt
产品应用8

实测 Seed 2.1:豆包基模超进化,国产模型能力跨过质变点

作者在做面向 Agent 项目时,因 Claude Code 内存开销大,需更轻方案。火山引擎 Force 大会发布 Seed - 2.1,作者实测其在办公、编程、图像理解等方面表现出色,认为它跨越质变点,将赋能国内 AI 生态圈。

特工宇宙