「智能体任务」共找到 4991 篇相关文章
4天100万下载,这个移动端Agent直接给谷歌偷家了。
蚂蚁的全模态助手灵光爆火,上线4天下载量达100万,三天冲上App Store总榜第六。它提前实现了谷歌AI Studio移动版的核心能力,以简洁报告输出和多智能体协作架构获市场认可,有望让创造力平权。
从《塞尔达传说》理解 Agent 的上下文工程:Claude Skills 还是被低估了
Claude Skills 是为 AI 设计的「技能包」,能把复杂任务指令打包。作者认为其信息分层设计哲学是关键突破,以《塞尔达传说》为例,介绍了信息分层和按需加载理念,还阐述了三层架构及应用案例、挑战和通用原则。
Andrej Karpathy 提出判断什么工作会被 AI 替代的新标准
Andrej Karpathy 提出判断工作是否会被 AI 替代的新标准,即不看复杂度看可验证性。他在 Software 2.0 框架下解释此现象,还指出任务被 AI 自动化需满足可重置、高效、可奖励三个条件,同时提及该框架有局限性。
AI时代CRM的重生之路:阿里云上的Salesforce如何改写SaaS规则?
AI 浪潮下传统 CRM 面临效率、合规与智能融合等问题。阿里云上的 Salesforce 展出“中国定制化 AI CRM”方案,历经六年探索,从合规、生态到 AI 闭环构建能力,通过多行业实践重塑企业增长逻辑,为 SaaS 行业提供范本。
AI能否「圣地巡礼」?多模态大模型全新评估基准VIR-Bench来了
来自日本高校和企业团队提出多模态大模型评估基准 VIR-Bench,用于评测 AI 对旅行视频中地理位置与时间顺序的理解。它将任务拆解,构建数据集,实验显示模型虽有改进但性能远未达标,指明了大模型进化方向。
Thinking Machines又发高质量博客:力推LoRA,不输全量微调
Thinking Machines 博客力推 LoRA 并与全量微调对比。研究发现小数据量任务中 LoRA 与全量微调效果接近,大数据量稍吃力,强化学习中低秩 LoRA 也能接近全量微调。还揭示了 LoRA 关键要素、超参数规律等。
云栖大会阿里掀桌子了!Qwen3-Max、VL、Omini、Agent ... 统统发布!
云栖大会上,阿里云智能首席技术官介绍千问多款新模型发布及一款升级。如万亿参数的Qwen3 - Max,代码和Agent能力强;还有Qwen3 - Coder - Plus、Qwen3 - VL、Qwen3 - Omni、Qwen3 - LiveTranslate等模型各有亮点。
DeepSeek正开发高级AI Agent模型,硬刚OpenAI
彭博消息,DeepSeek正开发高级AI Agent模型与OpenAI竞争。此模型能在极少指令下执行多步任务并自我优化,计划Q4推出。此前该司模型表现佳,技术已在多领域落地,但构建AI Agent仍有挑战。
DeepMind爆火论文:向量嵌入模型存在数学上限,Scaling laws放缓实锤?
DeepMind一篇关于向量嵌入局限性的论文在AlphaXiv爆火。其证明向量嵌入有数学上限,Scaling laws或放缓。研究构建LIMIT数据集,测试发现即便是先进嵌入模型也难解决简单任务,揭示了RAG系统约束,让人反思Scaling Laws边界。
智谱AutoGLM上线:给每个手机都装上通用Agent,AI从"对话"走向"操作"的里程碑
智谱AI上线AutoGLM,这是全球首个手机通用Agent,能让AI操作手机完成复杂任务。其技术架构强大,在多方面表现优异,与其他AI助手相比优势明显,还推出情感语音模型GLM - 4 - Voice,正推动大模型落地AI手机。