「长上下文推理」共找到 2089 篇相关文章
Claude Opus 4.7发布!这是你在别的公众号看不到的五个发现
Anthropic发布Claude Opus 4.7,编码和视觉能力提升,但长上下文能力下降。其231页的System Card藏着不少有趣发现,如Opus 4.7非最强模型、Claude知道被测试、模型审查自身评估等。
刚刚,GPT-5.4 发布,百万上下文、最强全能模型
OpenAI发布GPT - 5.4,集推理、编程等能力于一体,支持百万级上下文窗口。有三个版本,功能全面升级,如支持中途打断、电脑操作、视觉能力提升等,还更省token、少幻觉,安全机制完善,价格有调整。
GPT-5.2首发评测:大神深度体验两周,强到离谱,但慢得抓狂
为对抗谷歌的Gemini 3,OpenAI推出GPT - 5.2。大神Matt Shumer深度评测,指出其指令遵循、代码生成、视觉和长上下文等能力有提升,但速度慢。与Claude Opus 4.5、Gemini 3 Pro各有分工。
智谱AI、清华开源新视觉大模型:刷新41项纪录,同级别最强
智谱AI与清华联合开源GLM - 4.5V视觉大模型,它基于GLM - 4.5 - Air开发,架构独特。在42项主流测试中创41项新纪录,多领域表现超Qwen2.5 - VL等模型,还采用新训练策略。
Qwen3小升级即SOTA,开源大模型王座快变中国内部赛了
开源大模型进入中国时间,Kimi K2风头正盛时,Qwen3迎来升级,235B总参数量仅为Kimi K2四分之一,基准测试性能却超它。Qwen官方不再用混合思维模式,新模型仅支持非思考模式,此次是小更新,大招在后头。
刚刚!Ilya首个模型曝光了
前OpenAI首席科学家Ilya离开两年后,X网友爆料其创办的SSI正探索基于TTT的小型推理引擎,当前版本或8月向少数用户开放。该爆料与Ilya观点及英伟达合作等线索相符,但也面临安全难题。
李飞飞50亿美金赛道被开源!浙大教授章国锋带队创业,打造无限时长实时3D世界模型
2024年李飞飞创立的World Labs入局空间智能赛道,估值达50亿美元。近日影溯发布并开源实时帧生成模型InSpatio - WorldFM,由章国锋领衔,该模型突破2D局限,效率高、能无限时长推理,展现出高工程可用性。
硅基流动完成新一轮数亿元融资,打造开发者首选生成式 AI 开发平台
硅基流动完成数亿元 A 轮融资,由阿里云领投。创始人袁进辉称业务因开源大模型崛起和算力需求激增爆发式增长。公司推出高性能推理引擎等,产品服务多个行业,未来将深耕创新、推动 AI 应用。
Qwen3.8-27B 登顶全球开源榜第一,曾经的「源神」又回来了!
8月17日,阿里发布的Qwen3.8 - 27B成Hugging Face热门第一。它以27B参数在部分测试中与前沿闭源模型比肩,可本地运行。不过推理慢、真实任务表现待提升,它让前沿Agent能力下放到个人电脑。
吴恩达年终总结:2025是AI工业时代的黎明
吴恩达发表2025人工智能年度总结与公开信。总结指出,今年推理模型性能提升但有成本,AI人才争夺激烈、薪酬高,数据中心建设投入大,智能体让编程更高效。信中建议通过学课程、动手实践和读论文构建AI系统。