「多场景应用」共找到 6445 篇相关文章
当 Agent 尝试接管浏览器,连“我是人类”都证明不了?上海交大开源发布交互评测基准 HLL
随着多模态大模型发展,Web Agent 面临验证码挑战。上海交通大学等团队发布 HLL 评测基准,解耦真实度为三维度,对 8 款前沿模型测试,揭示 Agent 在多步交互微操上的短板。
最新 Anthropic 人类经济指数报告:AI 如何重塑经济?
Anthropic 持续监测 AI 实际使用情况,在第四份报告提出「经济基本要素」概念,分析2025年11月对话样本,探讨AI提效、任务时长、不同国家应用差异等,还评估职业受影响情况及对经济的总体影响。
清华朱军团队Nature Machine Intelligence:多模态扩散模型实现心血管信号实时全面监测
清华朱军等团队提出多模态生成框架 UniCardio,在单扩散模型中实现心血管信号去噪、插补与跨模态生成。它采用扩散模型和 Transformer 架构,结合持续学习范式,实验表现优,有望用于多领域。
DeepSeek开源新模型,提出上下文光学压缩:LLM的新记忆方式
DeepSeek开源OCR模型,探索用多少视觉信息让LLM理解文本。实验表明1000字文档约需100个vision tokens,压缩比10倍、准确率97%。还提出模拟人类遗忘等想法,有多种应用场景,且完全开源。
阿里重磅开源 0.5B TTS + 0.8B ASR,支持跨语种音色克隆、说唱识别!
2025 年 AI 圈风向变了,开始卷端侧模型。阿里 FunAudioLLM 团队发布 Fun - CosyVoice3 0.5B 和 Fun - ASR - Nano 0.8B,TTS、ASR 双线程开源,是工程级版本,目标是在本地跑顺‘听 + 说’。
宇树王兴兴,A股上市辅导公告了
宇树科技创业九年正式冲刺A股上市,其创始人王兴兴持股情况曝光。公司估值超百亿,产品涵盖多类型机器人,应用潜力大。当下具身智能领域投资火热,行业正迈向产业场景落地。
AICon 深圳 2026 全日程揭晓|聚焦 Agent 工程化,构建可靠智能的技术路径
8月21 - 22日,AICon全球人工智能开发与应用大会将在深圳举办。大会全日程已发布,产业一线技术专家将围绕Agent工程化等前沿方向,分享技术探索与工程实践,探讨AI从能力突破走向系统构建的新路径。
兄弟们,人都麻啦,网站克隆+AI生成前端,又一个卷王项目,这叫我还怎么卷啊!!!
Open Lovable由Firecrawl团队开源,输入网站URL,AI就能将其转换为可运行的React/Next.js应用。项目亮点是开源、支持多AI提供商等,可解决原型开发、旧站迁移等痛点。
MIT黑客松冠军让AI控制了人的手,被全网传成“AI夺舍人体”,我们和当事人聊了聊
2026年3月MIT黑客松上,六个学生用Claude API等拼出Human Operator系统,能通过电刺激让手指按琴键,拿下冠军。项目走红后传播失控,团队成员吴雨潼谈技术、体验及应用前景,称距产品化尚远。
一周10来个模型被开源,阿里Qwen杀疯了~
阿里通义千问这周开源众多模型,如Qwen3 - Omni、Qwen - Image - Edit等,涉及全模态、图像编辑、安全审核等多领域。各模型能力出色,如Qwen3 - Omni能处理多模态输入,Qwen3 - VL表现超部分闭源模型。