「安全与效用」共找到 7153 篇相关文章
我们对 Coding Agent 的评测,可能搞错了方向
用户对 Agent 不满常因它「做得不好」,不遵循指令和规范。当前主流评测体系以结果为导向,与真实场景错位。MiniMax 开源 OctoCodingBench 评测集,结果显示模型过程规范遵循不足,未来训练需引入过程监督。
智能PPT生成系统
MultiAgentPPT是基于A2A + MCP + ADK的多智能体系统,能流式并发生成高质量PPT。它通过多智能体协作,从大纲生成到内容汇总,提高效率与准确性,还介绍了使用界面、项目结构、快速开始步骤等。
PolyVivid实现多主体视频定制,身份一致性超越现有模型
现有视频生成模型在多主体定制中难保持身份一致与自然交互,上交和腾讯提出PolyVivid框架解决此问题。它在多方面优于现有方法,还介绍技术原理、演示效果,证明其在多领域有实用价值。
ICRA 2025|通用多机器人长时任务规划框架破解任务分配难题,成功率+105%、效率+36%
2025年5月,美两校联合团队在ICRA 2025发布LaMMA - P。它融合大模型与PDDL规划器,解决异构多机器人长时任务分配难题,在新基准数据集上,相比SMART - LLM,任务成功率提高105%,执行效率提升36%。
DeepSeek-V3.1 发布,官方划重点:Agent、Agent、Agent!
2025年8月21日,DeepSeek V3.1正式发布。它采用混合推理架构,支持双模式,网页端、App、API均升级,上下文拓展至128K。其智能体能力增强,思考与输出效率提升,还具备API新特性,模型已开源,价格也将调整。
深度实测「豆包工作」+飞书:目前最接近企业Agent终局的答案
「豆包工作」作为面向生产力场景的Agent产品正式发布,与飞书深度打通,给出了目前Agent进入组织的最佳答案。主流办公Agent基础能力趋同,企业上下文正成办公Agent分水岭,豆包工作+飞书优势明显。
马斯克彻底向ASI投降!10年后万亿财富都将「归0」
2026年7月23日,马斯克接受《经济学人》总编专访,给出AI发展时间线,称5年内AI智力超人类总和,10年内金钱无意义。他曾是AI末日论者,如今态度转变,还提出AI安全治理方案。
QClaw V2 升级:微信里直接用的龙虾,真正走入你生活和工作的个人助理
3月8日QClaw发布后文章爆火,近期产品迭代快。QClaw V2引入Multi - Agent机制,可创建多角色AI助手并行工作,还能连接主流办公工具,集成龙虾管家保障安全,实测功能强大,优势明显。
“2025年元宇宙典型案例”名单公示,首钢园入选!
新年伊始,四部门联合公示“2025年元宇宙典型案例”名单,首钢园凭借深厚积淀与创新实践,入选“典型园区案例”,是北京唯一入选园区。它在空间、产业、创新、场景等方面均有出色表现。
Ilya闹翻,奥特曼400万年薪急招「末日主管」!上岗即「地狱模式」
近日,奥特曼为OpenAI招募「准备工作负责人」,年薪55.5万美元加股权,约400万人民币起步。该岗位像「救火队长」,要管控AI风险,因当前AI风险更严峻,且OpenAI安全团队人员流失。