「好猜想」共找到 785 篇相关文章
Anthropic:警惕评测排行榜!差别可能只是机器的内存更大,而已
Anthropic发工程博客指出,AI编程评测排行榜上排名前列的模型分差小,而运行环境硬件配置能让分数波动6个百分点。同一模型在不同沙箱策略下分数不同,资源配置影响评测结果,排行榜分数差距或因硬件。
基础模型又一关键拼图,腾讯混元发布训练新范式「无相」:引入功能性记忆,打破静态权重枷锁
腾讯混元团队发布HY - WU范式,打破静态权重束缚,引入功能性记忆,实时生成个性化参数。应用于图形编辑基模效果好,在图像编辑任务表现优秀,还对未来AI架构提出多方面展望。
ChatGPT开测广告!OpenAI终于向“钱”看
OpenAI宣布在美国免费版及Go版测试ChatGPT广告功能,称是为支撑免费用户使用。广告不影响回答内容,会注明“赞助内容”。此外,新发布的GPT - 5.3 - Codex广受好评,还将推新聊天模型,其融资计划也在升温。
为什么AI总是"记错"你?我们造了一个"合成人生"来测试
现有AI记忆评测只记'事'不记'人',存在数据源窄、不重理解、注入成本高的问题。QuantaAlpha联合高校团队提出CloneMem基准测试,用'数字痕迹'评估AI Clone长期记忆能力,实验有反直觉结论并给出设计启示。
18 天做出来的产品,一个月留存 1%。OpenAI 抄袭 Skills?
2025下半年科技行业重速度,OpenAI开发Sora安卓应用仅18天,国内产品也纷纷发布。但快也有问题,Sora 30天用户留存率仅1%。此外,OpenAI人才策略激进,还被指抄袭。做产品应兼顾快慢。
跑分第一,实战拉胯!GPT Image 1.5被骂惨,奥特曼这波悬了
OpenAI推出新一代旗舰图像模型GPT Image 1.5,生图能力强,免费用户可上手,开发者能调用API。它在跑分榜单成绩优异,但网友实测发现是‘高分低能’,引发吐槽。此外,其API价格降20%,此次更新是回击谷歌。
我用这个开源的「智能体记忆操作系统」,30分钟做了一个AI备忘录应用。
文章推荐开源记忆项目MemOS,它是为智能体打造的记忆操作系统,能让AI有长期记忆体系。作者用其30分钟做出AI备忘录应用,还介绍了MemOS框架,称它是AI转变的关键基建。
Claude Code用不了?我给你开发了一个GLM Code
Claude Code虽好用,但存在订阅难、易封号、配置麻烦等问题。作者开发了GLM Code,一行命令就能用,安装简单、价格便宜、无封号风险,能力达Claude 90%,还给出使用步骤、适用人群等信息。
阿里新王牌千问 APP 曝光:全面硬刚 ChatGPT
11月14日阿里开启「千问 APP」公测,其集成通义千问 Qwen 系列顶尖模型,有多模态能力。它对标 ChatGPT,在中文语境和结构化输出上有优势,实测处理财报、麻将推理等表现佳。
谷歌DeepMind最新论文,刚刚登上了Nature!揭秘IMO最强数学模型
谷歌DeepMind的AlphaProof在IMO获接近金牌的银牌成绩。它结合大模型直觉、强化学习和Lean形式化证明解题,虽在速度、泛化和读题上有局限,但开启了人类数学家与AI协作新阶段。