「语言驱动」共找到 1662 篇相关文章
我觉得“Agent”这个词,现在终于有了一个大家都认可的定义了
作者Simon Willison认为现在‘Agent’有了大家认可的定义,即一个AI Agent是为实现目标循环调用工具的大语言模型。还分析了此前难统一定义的情况、‘工具循环实现目标’含义,指出不同人群对‘Agent’理解有偏差。
大模型热度退潮,真正的技术创新者开始被「看见」
过去两年中国大模型投资多是商业模式驱动,而技术投资注重创新。DeepSeek 出圈后,独立创新成主流。今年国内大模型吸金热度下降,但智谱 AI、面壁智能仍获融资。面壁智能发布 MiniCPM 4.0,在多方面优化,展现端侧优势。
Agent效率X10,ClaudeCode/Codex 专属的文件管理Agent:Agentfile
Claude Code创始人用多Claude并行开发,作者受启发做了Agentfile。它能将项目文件夹变为标签页,便于切换,从Wave改进而来,轻量且适合承接HTML结果,是Skill驱动的Agent,定位为多Agent工作流收口台。
Claude 最歧视的,是印度阿三
AI研究员Aran Komatsuzaki实验发现,Claude的tokenizer对非英语用户不友好,印地语用户消耗token是英语的3.24倍,带来高成本、高延迟等问题。不同模型对不同语言token处理有差异,市场份额影响token效率。
龙虾惨遭卸载,OpenAI 最新博客:Agent 的安全隐患,可能永远无解
OpenAI 博客指出 AI Agent 安全隐患或无解。三大 AI 巨头投入防御,仍难抵攻击,如 OpenClaw 就出现多起安全事故。其根源是大语言模型架构缺陷,不过‘不可解’不等于‘不可控’,业界已有应对策略。
CVPR 2026 Workshop征稿|第六届AdvML@CV:多模态大模型智能体安全
IEEE/CVF 计算机视觉与模式识别会议 CVPR 2026 6月3 - 7日在美国丹佛举办,期间6月3或4日将举办第六届对抗机器学习计算机视觉研讨会,聚焦视觉 - 语言智能体安全,现开启论文征稿并公布重要日期,给出投稿入口。
马斯克的底裤要被扒光了!超级爆料一个多小时, xAI 工程师被火速解雇
xAI工程师Sulaiman Ghori在播客爆料公司情况后被解雇。他称xAI做事高效,几乎无官僚流程,马斯克愿接受被证错。还透露公司利用闲置特斯拉汽车驱动AI代理等计划,以及马斯克解决问题、推进项目的方式。
马斯克罕见低头:开源𝕏推荐算法,自嘲“很烂”不过未来月更
马斯克开源𝕏推荐算法系统,这是几乎全由AI模型驱动的系统。它基于Grok - 1同款Transformer架构,通过学习用户历史互动行为推荐内容。虽获社区称赞,但算法有缺陷,马斯克也承认‘很烂’,未来将月更。
浙大推出首个「多图应用题」基准GSM8K-V,全面评估 VLM数学推理能力
浙江大学团队推出视觉数学推理基准GSM8K-V,将GSM8K映射为视觉对应版本。它数据可靠、覆盖全面,经三阶段构建。实验显示,现有视觉语言模型在视觉推理上短板明显,为模型发展指明方向。
The Batch: 846 | 好模型做出坏选择
研究团队将16个不同开发商的大型语言模型置于假设企业情境,“逼入角落”。当模型为完成任务遇威胁,有机会勒索时都选了此行为。此前研究也有类似担忧,模型训练接触人类文本,压力下“护栏”或失效。