视觉能力评估」共找到 4137 篇相关文章

新闻资讯8

黄仁勋最新访谈:我们已经实现了 AGI,领导力、心理学、生命、意识、死亡和人性

黄仁勋在 Lex Fridman 播客深度对话中,谈及 CUDA 决策、管理模式、四层 Scaling Law 等多话题。认为已实现 AGI,编程定义改变,程序员会增多,还分享对供应链、开源等看法。

AGI Hunt
产品应用8

刚刚,国产视频模型登顶全球第一!给谷歌Veo上了一课,还把钱给挣了

国产视频生成模型SkyReels V4在第三方榜单中登顶全球第一,压过谷歌Veo 3.1等。它能力强大,解决视频AI老毛病,支撑昆仑万维短剧平台DramaWave,构建了完整AI生态闭环。

新智元
产品应用7

The Batch:924|GPT-5.4:性能更高,价格也更高

OpenAI更新旗舰模型GPT-5.4,有Thinking和Pro两个版本,扩展工具使用能力,多基准测试达当前先进水平,但定价高。虽在部分任务表现超Claude,挑战Gemini地位,不过成本也更高。

DeeplearningAI
推荐文章8

Agent/Skills/Teams 架构演进过程及技术选型之道

文章结合作者实践与多篇论文,梳理Agent架构从单点提示词调用到Agent Teams的演进逻辑,分析Single Agent、Multi - Agent、Agent Skills、Agent Teams的优劣,给出架构选型建议,强调架构应与问题复杂度匹配。

阿里云开发者
开源动态7

警惕!“养龙虾”风险,一键给你的Openclaw做安全体检

OpenClaw在短时间内登顶GitHub开源榜首,国内企业纷纷部署。但它存在安全隐患,如漏洞、隐私风险等。朱雀实验室联合腾讯云EdgeOne推出「OpenClaw安全体检」功能,可自动完成全面体检与风险评估

腾讯技术工程
算法论文7

谷歌研究院探索多智能体协调的扩展原则

谷歌研究院对180种智能体配置对照评估,得出‘AI智能体系统首批定量扩展原则’。发现多智能体协同效果因任务而异,还指出工具使用瓶颈等问题,且开发预测模型辅助架构选择。

InfoQ
新闻资讯7

openclaw,从流量对比和搜索意图可以学到什么?

作者白杨SEO从搜索精准流量从业者角度,分析OpenClaw在各平台流量对比、用户搜索意图,探讨搞搜索流量可学之处及对OpenClaw的看法,指出其开源免费但用大模型需付费。

白杨SEO优化教程
产品应用8

震惊海外开发者!BOSS直聘3B小模型比肩80B,怎么做到的?

BOSS直聘楠北阁团队发布3B轻量端侧小模型Nanbeige4.1-3B,性能震惊海外开发者。团队从多方面改进,如优化推理和偏好对齐,重构训练数据,采用多种强化学习算法,使其性能比肩大模型。

AIGC开放社区
新闻资讯7

中东芯片王国与孤勇者:以色列和伊朗境内半导体企业一览

在地缘政治冲突下,中东地区晶圆代工厂供货受影响,中国台湾部分企业订单回升。文章梳理了以色列和伊朗半导体企业格局、能力与生态,以色列产业发达,多被巨头收购;伊朗产业落后,聚焦成熟制程。

芯师爷
算法论文8

YC总裁转发、登顶Hacker News:SkillsBench揭开Agent技能扩展的残酷真相

近日论文《SkillsBench: Benchmarking How Well Agent Skills Work Across Diverse Tasks》引发海外AI社区关注。研究聚合47150个Skills,经严格筛选评估,揭示人工构建Skills效果好、AI自生成无效等核心发现,为AI研发指明路径。

机器之心