「悟能平台」共找到 5999 篇相关文章
AI Agent组团搞事:在你常刷的App里,舆论操纵、电商欺诈正悄然上演
上海交大和上海人工智能实验室研究发现,多Agent系统中AI有群体恶意共谋风险。其开发MultiAgent4Collusion框架模拟作恶,发现去中心化团伙作案效果更好,还能应对现有防御体系。研究为研发防御策略提供工具。
谷歌2.5 Image:『你是我的神』,准备丢掉PS了
谷歌新出的大模型Gemini 2.5 Flash Image实现AI图像创作一致性、真实性新高度。它能理解手绘图表、解答问题及完成复杂编辑指令,可在Gemini和Google AI Studio免费使用,表现出色,有望取代很多PS任务。
GPT-5基准测试泄露,被曝两天后发布?打Minecraft震撼开挂网友直呼封神
GPT - 5消息不断,泄露的基准测试及Minecraft实测惊艳网友。有爆料称7月31日发布,也有消息指8月。它或统一o与GPT系列,编码能力强,能处理复杂编程任务,不过也引发对其影响的担忧。
Kimi K2 详测|超强代码和Agent 能力!内附Claude Code邪修教程
作者熬夜带来 Kimi K2 模型详测及 CC+K2 邪修教程。K2 是 1T 参数量的 MoE 开源模型,基准测试成绩优异,在代码、Agent、数学推理任务表现突出,前端能力强,还能驱动 Claude Code,成本低。
Agent RL和智能体自我进化的关键一步: TaskCraft实现复杂智能体任务的自动生成
当前智能体训练缺高质量任务数据,主流数据集依赖人工标注,规模和复杂性受限。OPPO 研究院提出 TaskCraft 框架,能自动生成智能体任务,构建并开源含约 41,000 条任务的数据集,支撑智能体训练评估。
Mistral的首个强推理模型:拥抱开源,推理速度快10倍
本周二,欧洲人工智能公司 Mistral AI 发布全新大语言模型 Magistral 系列,有企业版 Magistral Medium 和 24B 参数开源版 Magistral Small。它推理强、多语言表现好,速度比竞品快 10 倍,应用于主流云平台,成本有竞争力。
MiniCPM 4.0极速狂飙,端侧模型的比赛,结束了!
面壁智能联合清华发布MiniCPM 4.0,极限场景220倍加速。它是首个原生稀疏模型,有InfLLM v2、CPM.cu等创新,基准测试碾压对手,适配全平台,还有科研、工具调用等功能,标志端侧长文本时代到来。
刚刚,Claude水印一夜变废纸!
今早GitHub上一个去水印神器代码库爆火,狂揽11000颗星。它采用MIT开源协议,能抹除Claude等水印及相关文件鉴权数据。此前Anthropic高调展示水印技术,如今防线被打破,引发开发者对大公司傲慢的反击。
国产新模王Qwen3.7-Max,海外开发者已经沸腾了
阿里通义千问团队发布的 Qwen3.7-Max,或为面向 Agent 时代的旗舰模型。它能自主跑 35 小时、完成 1158 次工具调用,内核优化不掉线,多项评测领先,应用场景丰富,已上线且兼容主流框架。
工程知识引擎:Harness Engineering体系下的工程知识底座
现代软件开发中,AI编程智能体虽能写代码但难理解代码,缺乏工程约束与上下文支撑。为此构建工程知识引擎,整合多维数据源,有向量检索等六大能力,经评估可提升智能体效率与代码质量。