「多智能体治理」共找到 6607 篇相关文章
天使轮数千万元融资,这家公司想成为 AI 时代用户的安全执行顾问
主打认知安全的缔零科技获数千万元天使轮融资,资金用于「缔零法则」技术迭代等。其产品以AI治理AI,降本增效。公司曾推「缔零智数」,现「缔零法则」把控模型推理。未来有ToC计划,想成用户安全助手。
前百川联创下场、字节腾讯入局,到底谁在看好 AI 播客?
近期前百川智能联创焦可的‘来福’、前妙鸭相机产品负责人张月光的 ChatPods 等 AI 播客产品上线。‘来福’播客全由 AI 生成,国内多款同类产品也相继登场。虽产品效果能达及格线,但在多数播客场景难替代现有内容。
从被100家VC拒绝到英伟达、字节抢着投,AI视频独角兽CEO揭秘“奇葩”用人哲学:不招精英
Synthesia是专注企业级AI视频方案的平台,愿景是让会用PPT的人轻松做视频。创业初被100位投资者拒绝,获Mark Cuban支持后走上正轨。产品受众多公司使用,ARR破1亿美元,还获英伟达、字节等投资,CEO用人不招精英。
DeepSeek-R1今天一次「小更新」,颠覆了大模型格局,网友:尽快放R2
昨晚,DeepSeek官方宣布其R1推理模型升级到最新版本(0528),并公开模型及权重。该版本参数量高达6850亿,采用MIT许可证,性能提升明显,在多个基准测试中成绩优异,网友实测代码能力也大幅提升,但仍存在过度思考问题。
「人类造的最后一个AI」还有多远?一张图看懂OpenAI、Anthropic等大厂的RSI进度
本文报道中国前沿AI机构Theseus Labs联合多家产学研机构发布RSI领域研究报告,梳理全球72家头部AI厂商的RSI研发进展,提出五级RSI框架与HCI指标,拆解出可工程化的RSI发展路径,发布后在海外AI圈引发热议。
谈一谈TP推理场景下MoE Group GEMM的优化思路
作者在使用H20测试SGLang CUTLASS MoE时,发现其在中小Batch Size场景下性能不佳。为此设计Expert Specialization方案,启动多个不同配置Kernel,依Expert计算特性选合适的。还介绍了该方案在H20和Hx00上的实现细节及性能测试结果。
GPT-5得分不到0.4!法律+金融最大规模基准:1.9万+专家评估准则
新推出的PRBench基准可测AI在金融和法律领域表现。它有19356条专家评估准则,是该领域最大公开基准。顶尖大模型在困难子集得分低,还独创经济路径分析维度,约30%任务为多轮对话,揭示了AI在专业领域的不足。
阿里一口气发了N款新模型,让我们向源神致敬。
阿里云栖大会发布众多模型,有Qwen3 - Max、Wan2.5等。Qwen3 - Max对标顶尖模型;Wan2.5支持音画同出;Qwen3 - VL是强大视觉语言模型且已开源;Qwen3 - Omni是全模态模型。此外还有多个新模型,构建全场景生态。
OpenAI与微软分成曝新料!这家印度老厂哭晕:10年前白捐了10亿美元
近日外媒报道,OpenAI预计到本世纪末向微软分享的收入占比将从20%降至约8%,差额意味着其将多留存逾500亿美元。微软虽投资赚了钱,但也将OpenAI视为对手。而印度大厂Infosys 10年前捐10亿,如今股份“毫无价值”。
让AI像人类一样认知真实世界!UCLA谷歌强强联手,长时记忆+3D空间理解超越基线16.5%
如何让AI在3D环境中像人类一样思考,是具身智能领域难题。UCLA与谷歌团队带来3DLLM - MEM模型与3DMEM - BENCH基准,让AI有构建、维护和利用长时记忆能力,实验超基线16.5%,但有依赖模拟器预设的局限。