「自主推理能力」共找到 4917 篇相关文章
Claude 4.x 的提示工程实战指南
Anthropic在官方文档上线Claude 4.x提示工程指南,针对4.5系列模型优化。介绍基本原则、长期推理和状态跟踪方法、沟通风格,还给出特定场景指导及迁移考虑,助你发挥Claude 4.x实力。
拜拜了GUI!中科院团队“LLM友好”计算机使用接口来了
中科院软件所团队研究指出,现有LLM智能体成功率低、效率差的瓶颈在于GUI。其设计与LLM能力错配,团队提出声明式接口GOI,实现策略 - 机制分离,经测试性能提升显著。
老思维做 Agent,没戏!云厂商们又想憋大招了
企业落地 Agent 经历快速演化,自主性 Agent 成新趋势。云厂商起初推 AI Infra,现转以 Agent 应用为中心开启 Agent Infra 赛道竞争,虽已布局但新开发范式未成型,未来需产业链协作迭代。
表格理解新纪元!上交大等联合开源,半结构化表格问答准确率提升40%!
数据密集型工作中半结构化表格处理难,传统工具和GPT - 4o表现不佳。上海交通大学等联合开源ST - Raptor,通过VLM、HO - Tree算法和LLM推理,解决复杂表格问答问题,支持多格式,适用于多场景。
Notion 3.0 |AI转型最成功的互联网产品是怎么做的?
Notion更新3.0,可视为有所有上下文的通用Agent产品,能调用顶尖模型。它有基础AI能力,如选模型、加上下文等,还升级了Agent创建、MCP等功能,依托生态让提示词可变现。
第七届硬核芯生态大会暨颁奖典礼圆满落幕
2025年9月11日,第七届硬核芯生态大会在深圳落幕。大会探讨半导体产业多领域话题,如中国芯自主可控、并购趋势等,还揭晓‘2025硬核芯’评选结果,为优秀企业颁奖,推动中国半导体产业发展。
突发!字节开源 36B 模型Seed-OSS
字节跳动Seed团队开源Seed-OSS系列36B模型,用12T tokens训练,采用Apache-2.0许可证。该模型能灵活控制推理预算,有两个基座版本,Instruct版在多方面表现强劲,性能碾压OpenAI开源模型。
AI编程里程碑!谷歌AI自己写代码惊呆工程师,GPU内核算法反超人类21%
谷歌AlphaEvolve的开源实现OpenEvolve自学写代码,在苹果芯片上进化出比人类快21%的GPU核函数。它自主发现多项优化策略,经多维度测试,性能显著提升,开启「AI为AI编程」新时代。
Jeff Dean:一年内 AI 将取代初级工程师,网友:“Altman 只会画饼,Jeff 说的话才致命”
谷歌传奇工程师 Jeff Dean 在访谈中预测,一年内将有具备‘初级工程师’能力的 AI 系统。他还谈到 AI 发展方向、智能体潜力、大模型格局等,也提及硬件重要性及 AI 在科研领域的影响。
codex负责人:codex就要过时了
Codex负责人称两三个月后Codex将过时,因下一代模型要处理大规模并发Agent,非其能应对。Huggingface实验显示大小模型在不同harness下排名差异大,脱离模型谈harness过时或不适配说模型Agent能力都不妥。