「结果付费」共找到 688 篇相关文章
AI“压力面”,DeepSeek性能暴跌近30% | 清华&上海AI Lab
上海人工智能实验室等团队设计REST框架,在一个prompt里抛多问题模拟复杂推理场景。结果显示,DeepSeek - R1等模型高压下性能大幅缩水,REST能拉开不同模型差距,还揭示评测方法局限。
Who’s Adam?最逆天的NeurIPS评审出炉了
这两天大家收到NeurIPS 2025评审结果,网上现逆天评审意见,把Adam优化器当成拼写错误。投稿量飙升致审稿质量难保证,AI评审成普遍现象,还推荐了写反驳意见的博客。
3个工程师、0融资、不开会,估值3.5亿美元的Obsidian才是真正的「小而美」
Obsidian 作为全球最具影响力的本地化 Markdown 笔记应用之一,估值 3.5 亿美元,但仅 7 人全职团队。它拒绝资本,靠用户付费运营,有「无会议文化」,底层插件系统强大,和 Notion 信息管理哲学不同。
比爆火的OpenClaw更王炸?这台百元神机,已经能让AI长出手脚帮你打工了
英伟达DGX Spark因内存供应紧张涨价,4万的成本让预算敏感者望而却步。阿里云无影个人云超算服务性价比高,按量付费百元左右。其AgentBay让AI获“手脚”,还具OpenClaw没有的能力。
第七届硬核芯生态大会暨颁奖典礼圆满落幕
2025年9月11日,第七届硬核芯生态大会在深圳落幕。大会探讨半导体产业多领域话题,如中国芯自主可控、并购趋势等,还揭晓‘2025硬核芯’评选结果,为优秀企业颁奖,推动中国半导体产业发展。
OpenAI拿IMO金牌是火了,但惹怒大批人:抢发炒作,抢学生风头
OpenAI宣布其模型在IMO竞赛得分35/42获金牌,十分高调。但IMO曾要求AI公司赛后一周公布结果,避免抢学生风头。谷歌很低调,OpenAI却提前公布,引发不满。此外,其金牌成色也遭质疑。
国内首个免费提供的深度研究,反而有市面上最好的体验
秘塔深度研究(https://metaso.cn/)上线,是首个将深度研究作免费基础功能的产品。它在算法、交互等多方面优化,降低成本、保障准确,还创新交互形式,搜索结果清晰有条理,体验佳。
用Cursor做UI,最有效的两个方法
作者黄益贺分享用Cursor做UI的两个方法,免费法是用Gemini等生成JSON配置贴到Cursor;付费法是API调用Vercel的v0模型。还提及添加动画提升体验及前端UI开发工具箱。
刚刚,OpenAI前CTO:战胜LLM不确定性的方法找到了!
OpenAI前CTO创立的Thinking Machines Lab发布研究《战胜LLM推理中的不确定性》。研究指出LLM推理不确定性主因是批处理大小变化,而非常见认为的GPU并行性等。还给出实现批处理不变性的方案及实验结果。
6小时复刻AI IMO金牌成果,蚂蚁多智能体新进展已开源
2025年IMO赛场,顶尖大模型起初表现不佳后有突破。蚂蚁AWorld项目团队6小时复现并开源DeepMind解题结果,给出可一键运行系统。AWorld证明多智能体协同优势,还介绍复现思路、核心优势及体验方式。