「基准测试平台」共找到 3301 篇相关文章
专访微软CTO:微软大力发展Agent,智能体将无处不在
微软CTO Kevin Scott在“Build2025”大会期间接受专访,解读微软推动智能体生态发展。微软重视智能体应用,众多组织用其平台开发。他还探讨编程看法、行业变化、安全模型、市场模式等问题。
Meta CEO X 微软 CEO 对话解读:「蒸馏工厂」为何成为开源的魅力之源?
Meta CEO Mark Zuckerberg 和微软 CEO Satya Nadella 在 LlamaCon 2025 闭幕会议对话,探讨AI对技术平台等影响,如使文档、应用和网站界限模糊,还谈及开源与闭源模型战略价值及‘蒸馏工厂’概念。
claude 4摔碎了码农的饭碗~
昨晚Anthropic发布Claude 4系列模型,Opus 4编码能力强,SWE - bench测试成绩优,能完成7小时代码重构。Claude 4让完成日级任务的时间提前,各应用纷纷接入,部分产品有应对策略。
2025年哪款模型最受欢迎?Poe最新报告:DeepSeek降温、可灵成黑马
AI工具聚合平台Poe发布2025年1 - 5月人工智能模型使用趋势报告。显示模型市场份额消长明显,推理模型势头正劲,图像、视频、音频生成领域各有竞争态势,如DeepSeek降温,可灵成视频生成黑马。
一码难求的 Dia 浏览器,有了新进展
Dia 浏览器处于 Alpha 内测,需邀请码体验。测试反馈超预期,将打磨细节后发布。其优势是使用 AI 时能方便代入上下文信息,Chat 交互将成主流,Arc 部分功能会融合进 Dia。
『书生·端砚』全面开放全栈服务,“算、证、验”三合一,筑牢科学智能底座 | 2026浦江创新论坛
上海人工智能实验室在2026第十九届浦江创新论坛上,升级发布书生·端砚科学发现平台并全面开放全栈服务,升级三大核心能力,覆盖完整科研流程,已落地六大核心科研领域,开放给科研人员试用。
实测 Seedance 2.5 vs 可灵 3.0,谁能让我们无痛当上视频导演?
本文通过两大真实创作测试场景,对比Seedance 2.5与可灵VIDEO 3.0两款热门AI视频模型的表现,分析二者在画面表现、分镜执行、合规风控上的差异,为创作者提供选型参考。
奥特曼瘫坐叫停“GPT-6”训练!太强触发最高安全警报
OpenAI因模型或具网络攻击能力及此前入侵事件,全面升级研究环境安全。暂停模型训练,进行工作负载、网络隔离和安全测试,还扩展监控系统。期间推进对齐研究,未来用AI护AI,升级监控。
突发!OpenAI停止强化学习训练两周
OpenAI发文称暂停最新模型强化学习训练两周,加固研究环境、进行红队测试等。部分低风险训练已恢复,最大规模前沿模型训练仍暂停。此举源于Hugging Face安全事故及Astra模型潜在风险。
刚刚微软开源视频录制技能skill-recorder
微软开源视频录制技能 Skill Recorder,能将用户完成任务的过程转化为 AI 智能体可重复执行的技能。它捕获屏幕工作会话,用 GitHub Copilot CLI 重构操作,生成可复用内容,支持多平台。