「AI能力分布」共找到 11135 篇相关文章
2025 IMO真题撕碎AI数学神话,全球顶尖模型齐翻车!冠军铜牌都拿不到
2025 IMO数学竞赛中,全球顶尖AI模型均翻车。冠军Gemini 2.5 Pro仅得31分,连铜牌都拿不到。Grok - 4表现糟糕,DeepSeek - R1也令人失望。AI虽有思路,但逻辑细节不足,离成奥数大师尚远。
黄仁勋 × Lex Fridman:NVIDIA 4 万亿市值背后的 AI 革命
黄仁勋与Lex Fridman进行两小时访谈,从Amdahl定律聊到人类意识。谈及NVIDIA发展,如CUDA决策致市值下跌后回升;提出AI扩展定律,认为智能由算力决定;还分享管理、技术预判等看法及对中国创新的评价。
实测腾讯首个 AI IDE 产品,小白也能『批量开发』微信小程序
2025年AI Coding领域竞争激烈,腾讯7月22日揭幕国内首款“产—设—研”全链路AI IDE CodeBuddy。它支持主流模型,能将想法转化提示词等,通过多个案例展示其强大功能,腾讯还计划让其普惠开发者。
Anthropic 发布最新劳动市场影响报告:AI 已拿下 75% 的程序员工作、且能做的还有很多
Anthropic发布报告,用Claude真实使用数据度量AI对劳动市场的影响。提出‘观测暴露度’指标,显示AI远未达理论上限,高暴露职业集中在白领,目前失业率未升,但年轻人入职放缓。
每周产业洞察 | AI音视频模型能力全面嵌入“专业级视听内容”交付,对齐“制作级”
北京AIGC视听产业创新中心位于朝阳区,是朝阳区推动影视制作基地建设举措。由多方参与,首创郎园运营,提供六大服务平台,截至2025年8月汇聚近百家合作伙伴。首创郎园拓展服务能力,项目多地开花。
4 个月 3000 万美金 ARR,做 AI 评测榜单的 LMArena 为何值 17 亿美金
AI评测产品LMArena半年前种子轮获1亿美金,现完成超1.5亿美金A轮融资,估值达17亿美金。其核心产品Chatbot Arena可对比AI模型回答并构建榜单,公布的数据或解答了其估值高的疑问。
刚刚,微软CEO 宣布:AI 医生诊断准确率已达85.5%,是人类医生的4倍
微软CEO宣布其AI诊断系统MAI - DxO在304个病例测试中诊断准确率达85.5%,是人类医生的4倍。该系统模拟虚拟医生团队,既准又省,但也引发诸多质疑,微软认为AI是医生补充,未来是人机协作时代。
昆仑万维周亚辉投资笔记:AI时代的Super App之战打响|甲子光年
周亚辉认为AI时代Super App数量会大减,价值倍增。他预测张一鸣将成未来首富,字节在AI领域布局广。还提到马云的千问会是豆包劲敌,分析了美团、拼多多等企业在Super App之战中的情况。
腾讯AI Lab 提出解耦推理新框架,破解IMO 数学难题
腾讯AI Lab梁振文和宋林峰提出“解耦推理与证明”框架,解决当前大语言模型在自动化定理证明领域“思考”与“证明”能力失衡问题,成功解决5道IMO难题并开源成果。
炸裂!Claude以第一作者写论文反驳苹果「推理模型根本没有推理能力」:苹果有三大错误
苹果论文称推理模型无推理能力,引发争议。Anthropic的Claude Opus以第一作者写论文反击,指出苹果研究有混淆‘推理失败’与‘输出截断’等三大问题,还通过实验证明模型能力,强调需更聪明评估方法。