「成本性能」共找到 6932 篇相关文章
拒绝「降智、减配、乱收费」:面向LLM API的可信验证框架
大语言模型成AI应用基础设施,黑盒服务模式引发信任危机。研究者提出IMMACULATE审计框架,能在不暴露模型信息、仅1%额外开销下,验证黑盒LLM API执行完整性,检测违规行为,相关论文与代码已公开。
启发学习:让大模型认知从外化到内生
当下大模型能力多靠人为框架,能力上限受限。文章提出“启发学习”,将其集成到推理侧成Isaac框架,通过Prompt与网络层注入复用旧经验,实验显示能大幅提升大模型任务性能。
Anthropic最新2026趋势报告:人类最大一次编程革命势不可挡
Anthropic发布《2026年智能体编码趋势报告》,指出编程规则改变,任何人都能成开发者。报告给出8大趋势,如软件开发生命周期剧变、智能体能力提升等,还给出2026年组织需关注的4大领域。
Manus走了,原生Agent登场:“AI助手”的第三次重新定义
文章回顾“AI助手”三次预期校准,指出Manus完成Agent启蒙使命,随后分析Agent发展现状,提到其将从炫技到日常,还指出Chat时代落幕,中国模型创业者正加速,探索谁能成“中国的Anthropic”。
一码难求的 Dia 浏览器,有了新进展
Dia 浏览器处于 Alpha 内测,需邀请码体验。测试反馈超预期,将打磨细节后发布。其优势是使用 AI 时能方便代入上下文信息,Chat 交互将成主流,Arc 部分功能会融合进 Dia。
刚刚,清华团队养出了一只「龙虾老师」!教育版OpenClaw震撼开源
清华教育学院与计算机系联合团队开源多智能体AI课堂OpenMAIC。它能一键生成交互式课程,AI老师语音授课、AI同学互动。经两年真实课堂验证,支持主流大模型,有望成教育版ClawHub。
视觉领域的GPT-3时刻!DeepMind首次证明Veo3模型实现对物理世界建模和推理
谷歌DeepMind研究团队论文显示,视频模型Veo 3学会‘无师自通’,能处理多种没学过的视觉任务。研究人员将其能力分四级,还做了定量评估。研究认为机器视觉或正处范式转变边缘。
首个可学习姿态对齐的视频扩散模型!StableAnimator++
当前人像动画扩散模型在人物身份一致性上表现不佳,复旦大学联合多团队提出StableAnimator++,它是首个可学习姿态对齐的视频扩散模型,能生成自然保真的人物动画,还在保持人脸一致性上做了改进。
Arc浏览器创始人复盘:为何放弃百万用户及产品,押注AI浏览器?
Arc浏览器曾是新星,有上百万高粘性用户。2024年10月创始人透露将开发新AI-Native浏览器Dia,Arc进入维护状态。创始人复盘Arc错误,阐述转型原因,认为传统浏览器将消亡,Dia有机会成桌面端主流AI界面。
刚刚,千问杀入汽车座舱!阿里不止做超级APP,更要做超级入口
阿里AI助手千问被接入红旗汽车智能座舱,这是通用AI助手首次以完整形态登陆车载场景。千问能完成复杂语义理解和任务规划,还将拓展至更多硬件,阿里要把它打造成AI时代超级入口。