大模型Agentic推理框架」共找到 9784 篇相关文章

推荐文章7

一文看懂“提示词” vs “提示词工程” vs “上下文工程”

文章区分了提示词、提示词工程和上下文工程的概念。提示词是给AI模型的输入文本;提示词工程是设计、测试、优化提示词的过程;上下文工程是为大模型构建动态上下文的学科,在AI Agent背景下诞生。

宝玉AI
产品应用8

不卷速度卷验证,陈天桥MiroMind精准预测15天后黄金价格

陈天桥带队的MiroMind发布新一代重型推理智能体MiroThinker-1.7和MiroThinker-H1,在基准测试中表现优异,超越众多顶尖模型。该模型不仅通用任务强,在科技金融等专业领域也表现亮眼,还能承担真实长链条智力任务。

量子位
开源动态8

阿里 Qwen3:持续开源,SOTA 连连!

很多从业者有‘闭源模型一定比开源强’的刻板印象,而 Qwen 正打破此认知。最近阿里连发三款模型 Qwen3-235B、Qwen3-Coder、Qwen3-235B(Thinking),在多方向发力且拿下多个开源榜单第一。

特工宇宙
开源动态8

百度Qianfan-VL开源,纯国产自研昆仑芯跑出世界一流

百度开源全新视觉理解模型Qianfan-VL,有3B、8B和70B三个版本,在昆仑芯P800芯片上训练。该模型多模态能力强,OCR和教育场景表现突出,跑分超国际主流模型。芯片功耗低、架构优,模型训练方法创新。

AIGC开放社区
算法论文8

PPO-Clip的「盲点」被补齐了?快手提出熵比裁剪方法,从局部约束到全局稳定的关键一跃

快手科技语言大模型团队提出熵比裁剪(ERC)方法,应对强化学习中信任域偏离问题。该方法从全局视角稳定策略分布,在多个数学推理基准实验中提升了模型性能,还与多种方法对比验证了泛化能力。

机器之心
推荐文章7

吴恩达来信:Agentic编程与Agentic软件测试协同合作

在人工智能辅助编程时代,自主代理编程系统虽加快开发速度,但存在不稳定性。自主测试可对比代码与测试,对软件基础设施组件测试有益。吴恩达分享编程智能体问题及测试重点领域。

DeeplearningAI
开源动态7

告别单Agent,AI Agent进入团战时代!

上周CAMEL - AI开源Eigent,号称“全球首个桌面端多智能体生产力团队”,后脚Manus上线功能相似的“Wide Research”。本文分享Eigent内核,介绍其特色、与Manus对比,还深挖技术架构、MCP及容错机制。

探索AGI
新闻资讯7

手握30亿、被蚂蚁狂挖人,转型被骂惨的王小川,真的翻身了?

在大模型竞争中,2023 年成立的百川战略收缩聚焦医疗,起初内外存疑。2025 年,AI 医疗技术与应用进展显著,今年初大厂入局。百川如今开源 Baichuan - M3 模型,王小川认为医疗已入应用阶段、多模态非主战场,且国内 To C 更好。

InfoQ
新闻资讯7

刚刚,DeepSeek V4 Pro正式版发布!

周三晚间,DeepSeek 突然发布 V4 Pro 大语言模型正式版,命名为 DeepSeek - V4 - Pro - 0813,官方未调升 API 使用价格。有用户称调用的 V4 Pro 思维链风格有变,跑分显示其 Agent 评测表现可媲美顶级模型,还撞车了马斯克的 Grok 4.6。

机器之心
产品应用8

千问Qwen旗舰预览版Qwen3.6-Max-Preview发布

千问Qwen发布下一代旗舰模型早期预览版Qwen3.6 - Max - Preview,在权威评测中登顶最佳国产模型。此前开源的Qwen3.6 - 35B - A3B用30亿激活参数匹敌数百亿参数稠密模型,新模型在多方面给出技术演进方向。

AIGC开放社区