「企业级能力」共找到 4882 篇相关文章
BeyondSWE:AI编程80分是真的强,还是考卷太简单?
前沿模型在SWE - bench Verified测试中得分超80%,但该测试像开卷填空。中国人民大学提出BeyondSWE重新设计评测,规模是前者18倍,模型得分全跌破45%。还提出SearchSWE框架,结果显示搜索与编码能力融合待提升。
GLM-5封神,智谱市值五天翻倍,中国AI火力全开了
2026年春节档,字节跳动的Seedance 2.0与智谱GLM - 5成AI赛道“双子星”。GLM - 5在Coding领域开源与实战表现出色,标志中国AI迈向成熟。它能力比肩闭源模型,且配套工具链完善,还适配国产芯片。
杨植麟亲自发布,月之暗面最强模型Kimi K2.5开源
杨植麟发布月之暗面最强模型Kimi K2.5,经约15万亿视觉与文本混合数据预训练,有顶尖编程与视觉能力及智能体蜂群范式。在多基准测试表现优,成本低于对手,还能提升办公生产力。
北京亮牌了:4500亿,要把AI卷到底
1月5日,'2026北京人工智能创新高地建设推进会'召开,透露北京要在AI上搞大动作。2025年北京AI核心产业规模预计突破4500亿,还将建AI创新街区,发布多项补贴政策,多家机构和企业有新成果。
为 120 个 AI 项目做增长,矩阵魔方叶晨曦:优秀的增长团队,不能去「爱」自己的产品
叶晨曦带着近10亿营销经验回归AI赛道,分享AI GTM底层逻辑。他指出AI营销缺人,窗口期仅三个月;还谈到找差异化、破圈、营销预算等要点,强调创始人要身先士卒,职业创业者应“失去爱产品的能力”。
Agent狂欢下的冷思考:为什么说Data&AI数据基础设施,才是AI时代Infra新范式
文章指出Agent成AI主流叙事,但企业部署后效果不佳,因未认识到Agent平台无法单独构成AI Infra。强调数据是AI Infra核心,提出Data&AI数据基础设施是新范式,还分析赛道玩家并介绍科杰科技的实践。
The Batch: 846 | 好模型做出坏选择
研究团队将16个不同开发商的大型语言模型置于假设企业情境,“逼入角落”。当模型为完成任务遇威胁,有机会勒索时都选了此行为。此前研究也有类似担忧,模型训练接触人类文本,压力下“护栏”或失效。
假设 AI 未来真的能在写代码和系统设计上超过人类,那还有必要学习编程和系统设计吗?
文章围绕AI未来在编程和系统设计上能否超人类展开探讨。分析AI编程效率未达预期的原因,指出短期内不会有完全面向AI的软件架构,还强调学习编程和系统设计知识可培养解决问题的能力。
Anthropic CEO :AI 或致千万白领失业,呼吁对AI公司征税
Anthropic的CEO达里奥·阿莫代称AI发展或致严重就业危机,未来1 - 5年冲击就业市场,金融等行业入门级白领工作首当其冲。他认为无法暂停AI研发,呼吁思考应对之策,还建议对AI公司征税。
Soul APP 开源首个 14B 实时数字人!0.87秒延迟+32fps,冲进 I2V 趋势榜 TOP5!
AI圈对数字人爱恨交加,因其存在太假、太慢、太僵硬等问题。Soul App旗下AI团队开源实时数字人生成模型SoulX - FlashTalk,参数量14B,有亚秒级延迟、高帧率等亮点,冲进HuggingFace I2V趋势榜TOP5。