「视觉 - 语言智能体」共找到 4681 篇相关文章
Prompt | 人生金句炼金术师
作者分享“人生金句炼金术师”提示词,用其将平凡瞬间转化为哲理金句,如“想减肥没开始”“等红绿灯”等场景。给出不同风格卡片提示词,实测Gemini 2.5 Pro效果更好,还介绍了动态视觉图谱提示词。
The Batch: 846 | 好模型做出坏选择
研究团队将16个不同开发商的大型语言模型置于假设企业情境,“逼入角落”。当模型为完成任务遇威胁,有机会勒索时都选了此行为。此前研究也有类似担忧,模型训练接触人类文本,压力下“护栏”或失效。
Cursor终结者?Grok 4正式登顶!马斯克扬言编程碾压,20万N卡年赚47亿美金!
时隔5个月,xAI发布通用模型Grok 4,后续还将推三款模型。Grok 4上线,有三个订阅版本。马斯克称其智能超博士生,多项基准测试领先,编码或超Cursor。其性能强大源于训练投入和计算扩展。
多模态大模型不会画辅助线?最新评估得分:o3仅25.8%,远低于人类82.3% | 清华腾讯斯坦福联合
清华、腾讯、斯坦福等团队发布RBench - V基准测试,评估大模型视觉推理能力。结果显示,主流大模型如o3、Gemini2.5等准确率远低于人类,开源模型表现更差,暴露出大模型在复杂多模态推理任务中能力不足。
什么是系统提示词?如何逆向提示词?
大语言模型启动时会接收系统提示词,决定其角色、回答风格与安全边界。提示词逆向是试图获取或绕过该提示的行为。本文介绍其作用、逆向手法及开发者防御措施,助于安全使用和设计大模型。
开源版 Cowork 项目在 X 爆火,创始人:感谢 Cowork,让我们三年的探索被看到
Anthropic的智能体工具Cowork在X上爆火,CAMEL AI的开源项目Eigent作为平替也跟着火了一把。文章复盘了CAMEL AI从2023年发布CAMEL框架到Eigent项目的三年探索经历,介绍了Eigent的产品设计、技术架构、应用场景及发展情况。
图灵奖得主杨立昆:中国人并不需要我们,他们自己就能想出非常好的点子
本文是对图灵奖得主杨立昆的访谈,他批判当前大语言模型局限性,指出难以靠扩大规模达人类水平AI。还强调理解世界需非生成式架构,如JEPA。同时以DeepSeek为例,称开源发展更快,中国人能想出好点子。
告别「只会相似度检索」:腾讯最新T-Mem让AI学会「联想回忆」
当前大语言模型长期记忆方案均基于相似度检索,存在结构性盲区,无法在无字面/语义相似时召回关联记忆。腾讯团队提出T-Mem,实现AI联想回忆,已被EMNLP 2026接收,代码开源并上线QQ AI伙伴。
猫在说什么,AI知道吗?
近几年,结合AI的宠物翻译应用兴起,如MeowTalk。但动物语言研究面临无平行语料的难题。科学家通过记录声音与行为,让AI找模式,再用回放验证。目前AI虽有进展,但离听懂动物还差一步。
cursor翻车了,Anthropic:来,我教你怎么做long running Agent。
近期,Cursor宣称用大量智能体实现长程任务引发关注,但被指是营销惨案,代码存在诸多问题。Anthropic则分享务实的long - running思路,是记忆接力模式,代码可维护。未来模型能力提升或让代码成黑箱。