「大模型自信问题」共找到 9547 篇相关文章
Claude1.7万字系统提示词全网刷屏!Karpathy锐评:LLM训练缺乏关键范式
Claude近1.7万字系统提示词在GitHub泄露,网友称是提示技术的金矿。大神卡帕西提出系统提示学习新范式,模拟人类经验积累,让LLM有‘记忆’功能,引发网友激烈讨论。
AgentA/B:用AI模拟用户,真人AB测试或将成为历史
宾夕法尼亚州立大学和亚马逊合作研发AgentA/B测试框架,用大语言模型生成虚拟用户模拟真实行为,成本低、速度快,还能绕开真实流量测试。虽有人质疑,但它或改变传统AB测试。
AI 办公智能体横评:纳米Work / WorkBuddy / 豆包工作,谁才是理想AI助理?
本文作者亲测纳米Work、WorkBuddy、豆包工作三款热门AI办公智能体,从生态适配、模型支持、价格、实际任务完成度多维度对比,帮读者根据自身办公场景选到合适的AI办公助理。
Claude王座失守!OpenAI一夜反超,神秘GPT‑6 Sol偷跑
本文报道AI大模型领域最新战局,OpenAI在OpenRouter平台的开发者Token消耗付费流水,首次超越Anthropic Claude,终结了Claude两年半的统治,同时神秘GPT-6 Sol偷跑曝光,双方开启终极对决。
完成过亿融资,复旦博士要为不同端侧场景定制专属推理芯片丨对话淬思科技潘鸿洋
本文是对淬思科技创始人潘鸿洋的专访,潘鸿洋为复旦博士,淬思科技刚完成新一轮亿元融资,瞄准端侧AI推理成熟阶段的碎片化需求,主打定制专属推理芯片,采用AI原生设计流程压缩开发成本与周期,计划推进首颗商用芯片流片。
特斯拉为什么非要造Cybercab?|甲子光年
北京时间9月4日,特斯拉低调发布Cybercab,已进入奥斯汀Robotaxi运营体系。它专为Robotaxi打造,无方向盘与踏板。文章探讨特斯拉造它的原因,涉及成本、生产等,也指出业务面临财务和法规问题。
5个月估值翻10倍,AI数据赛道跑出一家新独角兽
成立约18个月的AI训练数据公司AfterQuery正筹新一轮融资,估值达32亿美元,5个月涨超10倍。它最初想开发AI智能体,后转收集训练材料。此赛道已有多家高估值公司,且数据隐私和安全风险待解。
癌症疫苗爆火后,mRNA再迎突破:新技术有望让RNA在体内“活得更久”
8月19日,Moderna与默沙东个体化mRNA癌症疗法试验有阳性结果,引发mRNA话题热议。次日,名古屋大学与富士胶片针对环状RNA开发新LNP递送系统并验证功能,触及RNA长期治疗关键问题。
刚刚,Claude水印一夜变废纸!
今早GitHub上一个去水印神器代码库爆火,狂揽11000颗星。它采用MIT开源协议,能抹除Claude等水印及相关文件鉴权数据。此前Anthropic高调展示水印技术,如今防线被打破,引发开发者对大公司傲慢的反击。
专访火思动力Kevin Ding:未来选择Agent,要看它过去三十天学会了什么|甲子光年
本文是对火思动力创始人Kevin Ding的专访。他指出当下Agent会工作但不会成长,而如今市场需求、技术条件和数据供给成熟,可开展持续学习。他还阐述了后训练、产品应用、商业化等方面观点。