「AI推理能力」共找到 12096 篇相关文章
DeepSeek-V3.1 发布,官方划重点:Agent、Agent、Agent!
2025年8月21日,DeepSeek V3.1正式发布。它采用混合推理架构,支持双模式,网页端、App、API均升级,上下文拓展至128K。其智能体能力增强,思考与输出效率提升,还具备API新特性,模型已开源,价格也将调整。
他们,诠释了 QCon 的技术厚度 | 2025 QCon 上海站优秀出品人与明星讲师揭晓
2025 QCon全球软件开发大会(上海站)圆满落幕,超1300人参与。大会聚焦可持续工程能力建设,强调‘落地实践’。收官之际揭晓优秀出品人与明星讲师,他们推动知识流动,诠释QCon技术厚度。
Claude Code 修了几个小 bug,却揭开了 Agent 落地的大麻烦
Anthropic给Claude Code发的更新,看似是修小bug,实则指向AI编程产品正从“模型会不会写代码”转向“Agent能否稳定完成任务”,暴露了工具状态、权限边界等执行问题。
「谷歌搜索」过时了!10秒KO,ChatGPT秒解五年医学谜团
一位患者下巴疼痛咔咔声五年未解决,求助ChatGPT,它几秒给出建议,患者练习一分钟症状缓解。此案例引发关注,展现其解决实际问题潜力,还体现人们与AI互动方式的变化。
对话 Synergy 团队:「龙虾」之后,下一代智能体正演变为「互联网公民」
两年间,AI Agent能力与数量爆炸。Synergy团队认为,下一代智能体应是“智能体公民”,需跨过建立身份、学会协作、实现进化三道门,还探讨了其对互联网的影响及人机共处问题。
神秘「欢乐马」霸榜视频模型!本以为Seedance2.0已封神…
神秘模型HappyHorse - 1.0悄然登顶Artificial Analysis的AI Video Arena排行榜,在多个赛道力压Seedance等模型,呈现断层式碾压。它或出自阿里淘天未来生活实验室,据说完全开源,10号将正式发布。
国产大模型高考出分了:裸分683,选清华还是北大?
字节跳动Seed团队公布全球第一梯队大模型“高考成绩”,Gemini理科655分排第一,豆包文科683分排第一、理科648分排第二。文章解析评测标准,分析各科目表现,还介绍豆包能力提升技术亮点。
Nano Banana 2突然现身!能画公式解数学题,监控画面都能伪造
Nano Banana 2代以预览版现身第三方网站,后被移除。其能力远超1代,能处理复杂提示,可生成复杂UI、解数学题甚至伪造监控画面。谷歌正将Nano Banana整合进核心产品生态。
一手实测 Amazon Quick:我看到了企业级 Agent 的未来!
本文针对企业AI工具碎片化、员工沦为Agent间搬运工的痛点,对刚GA发布的亚马逊云科技Amazon Quick做一手实测,分析其核心能力与壁垒,判断企业级Agent发展趋势。
Anthropic滑跪认错!Claude暗中降智实锤
开发者argofowl排查后发现Claude Code将「high」推理程度读成原本「low」对应的值,原来Anthropic在做实验。科技博主曝光后AI圈炸锅,工程师虽回应,但Opus 5也被指降智。