大模型Agent」共找到 10562 篇相关文章

新闻资讯8

多模态文本智能白皮书发布!5能力标准、11个行业案例全解析(附下载)

合合信息发布《文本价值觉醒,赋能智能决策——多模态模型文本智能白皮书(2026)》,提出复杂文本智能五核心能力标准,还通过11个真实行业标杆案例展示技术如何转化文档为决策力。

PaperAgent
新闻资讯8

震撼!OpenAI神秘模型连破6道前沿难题,奥特曼:AI在造「新知识」

OpenAI首席科学家爆料,其神秘内部模型一周攻克10道未发表顶尖数学难题中的6道。First Proof团队用公开模型测试,结果冷峻。虽OpenAI实际命中率或低于宣称,但AI解前沿题意义重,也暂无法取代数学家。

新智元
开源动态8

Hermes Agent 技术深度拆解:36000 Star 背后的架构设计,以及你该怎么用它

Hermes Agent 9 个月获 36800 Star,解决记忆断裂、能力天花板和平台绑定问题。它有四层记忆架构、自主技能进化,支持 200+ 模型,还有 40+ 内置工具、15 个平台适配器。最新 v0.8.0 版本有多项更新,文章还给出使用建议和对比。

AI Reading Hub
产品应用7

newtype OS操作手册

作者黄益贺介绍newtype OS安装、配置与使用方法。它是定制化工具,比Claude Code更适合知识消化与内容产出。安装简单,配置需连模型供应商、给Agent模型,使用时与Chief对话即可。

newtype AI
新闻资讯7

Anthropic 技术栈里的「五宗罪」由何而来?

Anthropic的Claude模型升级后,用户却觉得不好用。X上帖子指出其存在文本和代码标记、模型能力、定价、长上下文等问题,这些问题卡在生成、计算、上下文和Agent运行时的5个具体位置,导致各方面互相拖后腿。

AI科技评论
产品应用7

全球首个龙虾模型 GLM-5-Turbo 发布:已经在用它帮我省几千块钱了

作者作为公众号编辑,排版耗时久费钱。他测试多款模型驱动龙虾排版均失败,换上智谱 GLM - 5 - Turbo 后成功,还能让其操作飞书润稿。该模型工具调用稳定,虽 API 涨价但性价比高,未来潜力

特工宇宙
Product Application7

PDF难点解析:处理复杂表格、水印、印章、复选框、信息抽取等7项任务,6能力

文章介绍Nanonets - OCR - s可处理关键信息提取、视觉问答等7项任务,具备LaTeX方程识别、图像描述等6项能力,还给出体验链接。但测试发现英文体验优于中文,模型有重复输出、幻觉严重问题。

CourseAI
新闻资讯7

李飞飞一年前究竟说了啥?怎么又火了

AI教母李飞飞一年前访谈再引关注,她指出语言模型或许并非真正智能,其基于一维语言信号训练,在理解三维物理世界存在局限。相关实验也证实模型在物理任务表现差,不过也有人提出不同观点。

量子位
开源动态8

预训练就学会思考!字节、北等用14亿参数,撬动百亿模型推理能力

字节、北等联合发布Ouro模型,用14亿参数实现百亿级模型推理能力。它在预训练阶段学会循环思考,通过三创新构建推理能力,在基准测试中表现优异,实现参数效率提升,是潜在推理范式的胜利。

AIGC开放社区
推荐文章7

“不用 Cursor和 ChatGPT、手写代码的开发者,怕不是疯了?”

本文围绕开发者是否应使用AI辅助编程展开讨论。支持者认为模型能提升效率,解决琐碎问题;反对者则质疑其可靠性。文中还分析了模型在编程中的优缺点,如能生成代码但也有幻觉等问题,并反驳了一些反对观点。

InfoQ