实例级重加权」共找到 970 篇相关文章

算法论文8

谢赛宁团队新基准让LLM集体自闭,DeepSeek R1、Gemini 2.5 Pro都是零分

纽约大学等8家机构研究者提出LiveCodeBench Pro竞技编程基准测试,评估了Gemini 2.5 Pro等前沿大模型。发现当前模型有显著不足,在无外部工具时,高难度题通过率为0,LLM与人类大师水平差距明显。

机器之心
新闻资讯7

独家对话希捷科技Jason Feist:AI时代,企业正在“删除删除键”|甲子光年

本文是「甲子光年」对希捷科技云存储业务高副总裁杰森·费斯特的独家对话。费斯特指出,AI 基础设施正从计算、内存转向存储,企业倾向长期保存数据,高容量硬盘重要性凸显。他还探讨了存储系统变化、技术创新等问题。

甲子光年
产品应用8

智谱开启狂飙模式!7倍提速,全球最快,旗舰模型即问即答

5月22日,智谱上线GLM - 5.1高速版API,输出速度达400 tokens/s,刷新全球大模型API速度纪录,比原版提速约7倍。该速度由GLM团队和TileRT团队联合打造,核心优化分三层推进,且是稳定可用的生产能力。

AIGC开放社区
产品应用7

聊聊钉钉的悟空:给一个还没人走路的市场卖跑鞋?

钉钉发布悟空,与其他大厂先面向个人用户不同,它走企业路线,有四层Skill体系等,虽初期被认为‘太重’,但钉钉全产品CLI化等创新有潜力,且安全设计是企业刚需,适合特定人群关注。

刘言飞语
产品应用7

AI 编程工具在大型企业“遇冷”?网易 CodeWave 升研发模式,不只关注“代码生成”

近些年,自然语言编程成 AI 编程产品主流。C 端通用 AI coding 工具表现出色,但国内企业市场 AI 技术渗透率低。网易 CodeWave 专注企业场景,指出通用工具痛点,提出‘可控的 AI coding’定位并升能力,未来还将推新开发模式。

AI前线
算法论文8

万字硬核解读SAM 3:不止分割一切,它开始理解世界了

Meta的SAM 3能理解语义,实现可提示概念分割。它支持开放词汇、全实例分割等,架构有创新,数据引擎高效。评估显示其性能优异,与MLLM结合成SAM 3 Agent后推理分割能力强,但在专业领域和复杂场景有局限。

AIGC开放社区
新闻资讯7

a16z 全球 AI 产品 Top100:DeepSeek 增长放缓,「中国开发,出海全球」成为新常态

时隔半年,a16z发布第五版「Gen AI消费应用Top 100」榜单,显示AI应用生态趋于稳定。Google旗下产品增长快,Grok移动端用户大增,DeepSeek增长放缓,「中国开发,出海全球」成AI应用新常态,vibe coding类应用用户粘性高。

Founder Park
产品应用8

有生之年吃到了钉钉的细糠

作者参加“2025 钉钉十周年暨新品发布会”,体验了钉钉 8.0 版本。该版本开启 AI 1.0 新篇章,界面焕然一新,以钉钉 One、AI 搜问等重塑工作流程,还升语音智能硬件,实现信息处理闭环,提升企业与员工效率。

MacTalk
产品应用7

百度智能云 DuMate 测评:办公 Agent 教我用 Claude Code,效果如何?

百度智能云桌面AI智能体DuMate于今年3月22日全量上线。本文对其进行测评,设计围绕GitHub项目的复杂任务,测试它在研究、整理、文件生成和展示化输出的表现,探讨办公Agent从内容提供商到办公搭子的转变。

AI科技评论
新闻资讯8

从工具到生命形式:OpenClaw 引发的 Agent 再思考

InfoQ《极客有约》X QCon 直播邀业内专家探讨 OpenClaw 落地难点。专家认为,这波 Agent 热潮验证了复杂工作可被系统承接,也指出 OpenClaw 虽非生产产品,但推动了全民 Agent 浪潮,同时探讨了模型与编排层结合、记忆系统等问题。

AI前线