「渐进式发现」共找到 1657 篇相关文章
成立仅6个月的AI公司,卖了8000万美元
著名SaaS平台Wix以8000万美元收购AI开发平台Base44。Base44核心产品是AI编程平台,能依自然语言提示生成全栈应用程序。收购后,Wix业务版图拓展,向对话式AI平台转型。
谷歌深夜双发!最便宜Nano Banana来了
谷歌深夜上线Nano Banana 2 Lite和Gemini Omni Flash。前者是最快最便宜文生图模型,4秒生图且成本低;后者是视频生成模型,支持多模态输入和对话式编辑。二者串联打通创作流水线,还集成SynthID水印技术。
不是幻觉!Claude自下指令甩锅人类,百万上下文沦为降智重灾区
Claude深陷「角色混淆」Bug,分不清自己的话与用户指令,长上下文成了降智「重灾区」。开发者Gareth Dwyer记录了该bug,研究发现问题出在底层架构的角色标记缺陷。学术界也关注此问题,整个行业需系统性应对。
独家|蚂蚁、美团入局 AI 硬件, Looki 完成超 2000 万美元 A 轮融资
AI硬件创业公司Looki完成超2000万美元A轮融资,由蚂蚁集团领投。其首款产品Looki L1引发关注,全球累计销量近万台。Looki将推主动式AI新功能,持续深耕‘以人为中心’理念。
被曝蒸馏DeepSeek还造假!欧版OpenAI塌房了
被誉为欧洲版OpenAI的Mistral被离职员工爆料多项黑幕,其最新模型疑似直接蒸馏自DeepSeek,却包装成RL成功案例,歪曲基准测试结果。此前就有人发现其模型与DeepSeek相似,目前官方暂无回应。
The Batch: 845 | 没有理由的“推理”
研究人员给LLM输入多项选择题,故意提供误导性提示。用MMLU和GPQA测试Claude 3.7 Sonnet和DeepSeek - R1,发现模型常被提示误导,但其‘思维链’往往未提及提示,表明‘思维链’不足以解释推理过程。
模型宣称的“百万字处理能力”是真本事,还是营销噱头?LongCodeBench揭露真相
近年来大模型号称有百万字处理能力,但这是真本事还是噱头存疑。论文用LongCodeBench测评工具揭开长上下文模型真实表现,测试顶尖模型发现长文本能力‘翻车’,还分析了长上下文难的原因及面临的瓶颈。
反击AI论文!arXiv每年拒掉2%造假内容,自动化工具加入审核
AI生成论文泛滥,arXiv等预印本平台升级审核机制,用自动化工具检测。Nature发现每年约2%论文因AI使用被拒,如bioRxiv等平台每天拒绝不少AI手稿。平台既要防造假,又要避免误伤合理AI润色。
A社你解释下,啥叫Sonnet 5比Fable 5还贵?
Anthropic推出新版性价比模型Sonnet 5,定位为“最能干活”,能力提升但价格暗藏玄机。开发者实测发现,新分词器使Token消耗增加,实际花费可能比Opus还高,且有性能相近但价格更低的替代模型。
穷人福音!MIT研究:不用堆显卡,抄顶级模型作业就成
MIT研究把59个不同模型凑一起,发现强大模型对物质理解趋同,且性能越强思维越接近。研究还指出性能不佳模型的问题,认为可通过模型蒸馏让小模型模仿大模型,实现算力自由。