成本性能」共找到 6932 篇相关文章

新闻资讯8

李飞飞3D世界模型公测,网友已经玩疯了

今日李飞飞创立的World Lab推出全新3D世界生模型Marble并开启公测。普通人靠文本等生专属3D世界,还在VR体验。它功强大,未来将重点发力交互性。

量子位
开源动态8

Clawdbot爆火:Karpathy点赞的开源AI助理,到底是什么?

这两天AI圈被Clawdbot项目刷屏。它是在手机已有应用中工作的AI助理,有记忆、会主动联系用户、执行任务。它可在廉价云服务器运行,力分两层级,本每月25 - 150美元。

AI寒武纪
新闻资讯8

刚刚,Anthropic分享了他们在AI Agents评估的最佳实践

Anthropic发布blog《揭秘AI Agents评估》,指出良好评估助团队信心发布AI智体,介绍评估结构、构建原因、评估方法、从零到一的路线图,还提到评估需与其他方法配合,全面了解智体性

PaperAgent
产品应用8

英伟达联手QCI搞大事:量子应用在真机前先模拟纠错

量子电路(QCI)公司联合NVIDIA,将CUDA - Q编程力集到Aqumen软件套件。QCI的双轨量子比特设计易纠错,有检测、控制流、处理错误三大功。二者结合让开发者在真机前模拟纠错,加速量子计算商业化。

AIGC开放社区
产品应用8

4个月11万用户、Claude Code了,Dogfooding该被AI公司重视起来了

Dogfooding(内部试用)应被AI创业公司重视。Anthropic推出的Claude Code源于内部工具孵化,经内部使用和场景验证后发布,四个多月获11万开发者用户,其功说明深度内部试用是竞争优势。

Founder Park
推荐文章7

The Batch: 893 | 从预测到执行

2026 年 AI 研究应认识到预测的模型不等同于行动的系统。过去十年在被动预测和生建模就非凡,但现实任务需系统执行一系列动作。转向长周期任务和目标导向 AI 系统有两大好处。

DeeplearningAI
算法论文8

TRM思考奖励模型上线,大模型推理质量终于量化了 | ICML‘26 Oral

大模型推理评测多只看答案,忽略推理过程。上海多校团队提出TRM,用ME² principle刻画推理质量,DAG-based pairwise evaluation还原结构,训练奖励模型,让推理质量可度量、训练和优化。

量子位
算法论文7

「你是专家」竟AI幻觉毒药?新论文一巴掌揭穿提示词最大骗局

最新论文证实,「让AI装专家」会可测量、持续地降低模型的准确率。研究发现,Persona Prompting的效果依赖多因素,专家人设提升的多是「对齐感」。为解决问题,研究人员发明PRISM算法。

新智元
新闻资讯7

Claude Code 一小时「复刻」谷歌一年果,那一年读完五年半的博士吗?

X博主Yuchen Jin感慨读博时若有AI工具,一年就毕业。谷歌工程师称Claude Code一小时果抵谷歌一年。网友对AI工具在工作积极认可,但在教育作用上看法不一,争论持续。

机器之心
推荐文章7

Skill 和 CLI:经验指导力,力丰富经验

本文以作者自身使用飞书和 YouMind 工具的经历为例,探讨了 CLI 和 Skill 的关系,指出它们并非上下级,而是像菜谱和菜刀,相互配合。官方设计也体现了二者深度咬合,还给出使用判断口诀及 Skill 链玩法。

AI产品黄叔