模式化推理」共找到 3493 篇相关文章

开源动态8

AI点外卖哪家强,美团LongCat团队做了个全面评测

美团LongCat团队发布贴近生活场景的大模型智能体评测基准VitaBench,以三大高频生活场景为载体,构建含66个工具的评测环境。评测显示现有智能体与应用需求差距大,该基准已全面开源。

量子位
产品应用8

谷歌 DeepMind 推出 CodeMender:自动修复代码的智能代理

谷歌DeepMind推出CodeMender,这一AI驱动的智能代理能自动检测、修复并加固软件漏洞。它结合多种技术推理程序行为,生成修复方案经自动测试和人工审核后提交。社区反响积极,长期影响待察。

AI前线
推荐文章8

从Transformer到Agent:生成式AI行业技术路线与职业发展指南,深度解析AI价值链

文章深度解析生成式AI行业,介绍其宏观图景、商业运作、行业定位与战略考量。指出行业价值链呈“杠铃”形态,应用层机会大,还提及盈利模式、岗位薪酬、开源闭源之争等,为从业者提供职业指南。

AI Reading Hub
算法论文8

一篇大模型Agentic框架到应用最新综述

这是首篇系统拆解“大模型Agentic推理框架”的综述,不聊训练,只聚焦如何把LLM组织成会思考、协作、调工具的Agent,横跨科学发现、医疗、软件工程、社会经济模拟四大战场,给出统一语言、视角和评测。

PaperAgent
新闻资讯8

云栖大会阿里掀桌子了!Qwen3-Max、VL、Omini、Agent ... 统统发布!

云栖大会上,阿里云智能首席技术官介绍千问多款新模型发布及一款升级。如万亿参数的Qwen3 - Max,代码和Agent能力强;还有Qwen3 - Coder - Plus、Qwen3 - VL、Qwen3 - Omni、Qwen3 - LiveTranslate等模型各有亮点。

探索AGI
产品应用8

快手发布Keye-VL-1.5,同量级SoTA,让模型真正看懂视频!

近年来,多模态大语言模型兴起,但视频理解仍是难题。快手Keye团队推出Keye-VL-1.5,通过Slow-Fast编码策略、渐进式四阶段预训练和全面后训练流程等创新,实现视频理解突破,综合性能领先。

深度学习自然语言处理
推荐文章8

OpenAI 最新报告:让团队变得 AI Native 的五大原则

OpenAI 发布白皮书《Staying ahead in the age of AI》,基于与国际大公司合作经验,提炼出让团队变得 AI Native 的五大原则,即对齐、激活、放大、加速、治理,还给出各原则策略及反思问题。

特工宇宙
新闻资讯8

红杉美国:未来一年,这五个 AI 赛道我们重点关注

红杉资本分享未来 AI 投资判断,认为 AI 革命堪比工业革命,蕴含 10 万亿美元机遇。未来 12 - 18 个月,将重点关注持久记忆、通信协议、AI 语音、AI 安全和开源 AI 五大主题,这些也是创业好赛道。

Founder Park
新闻资讯8

第一名方案公开,代码智能体安全竞赛,普渡大学拿下90%攻击成功率

亚马逊举办代码智能体安全比赛,普渡大学团队 PurCL 作红队以超 90% 攻击成功率夺冠。他们耗时八月、花百万美元开发全过程红队系统并开源,还发现当前 AI 安全研究在复杂领域对齐有挑战。

机器之心
产品应用7

DeepSeek有点含蓄了,实测V3.1有进步,编程等个别场景硬刚GPT-5

DeepSeek悄悄更新V3.1,官方仅提及上下文长度拓展至128K。实测其代码能力与前端审美提升,逻辑推理也有进步,在编程等个别场景能硬刚GPT - 5,但处理复杂任务还有距离,更新不大却有进步且降价。

鲸选AI