「可灵2.5 Turbo」共找到 6551 篇相关文章
视频模型也能推理,Sora2推理能力超过GPT-5
DeepWisdom团队研究发现视频生成模型能推理,在空间类任务上比图文模型更擅长。团队推出VR - Bench基准测试,构建客观评分体系。实验显示视频模型在空间推理有优势,相关代码和数据集已开源。
kimi 的RL end2end ON LLM
文章分享Kimi Researcher背后技术思考,采用端到端强化学习打造大模型Agent。对比传统方法,凸显其灵活通用、能力上限高、可扩展优势。还展示其在考试榜单成绩提升及智能“涌现”,介绍多应用场景。
CVPR 2026 Workshop征稿|从感知到推理,ViSCALE 2.0 邀你重塑计算机视觉的 System 2
2026年6月,CVPR第二届计算机视觉推理扩展研讨会(ViSCALE 2026)将在美国回归。由顶尖机构学者联合举办,将汇聚顶尖学者探索视觉模型突破瓶颈之法。会议亮点多,还开启论文征稿,欢迎积极投稿。
斩获5.5K star!!AI 加持到位,安全感拉满,这个升级版开源知识库神器太顶了!
两个月前分享的开源AI知识库项目PandaWiki,迭代速度惊人。此次更新多个大版本,编辑器体验提升,AI成智能客服,支持20+家模型供应商,还优化团队协作功能和诸多细节,更成熟实用。
DeepSeek-R2为什么还没发?
全网期待的DeepSeek - R2再次被曝推迟。The Information称因CEO不满其表现,且可能因缺英伟达H20芯片致研发慢。回顾其“难产”过程,网友看法不一,有人认为延迟值得,有人推测要等V4。
使用 GPT-5 进行编程的六个技巧
OpenAI给出使用GPT - 5编程的6个提示技巧,如指令准确无冲突、选对推理力度、用类XML语法结构化规则等,还提供了详细提示技巧的参考链接。
Sora2甚至可以预测ChatGPT的输出
Sora2表现太卷,能预测ChatGPT输出,模拟交互还能渲染HTML,懂代码也懂物理,能体现玻璃折射现象,还能精准还原游戏支线任务关键要素,或基于LLM训练。
视频实时生成可交互! 两位自动驾驶大牛创业世界模型:40毫秒/帧,无需任何游戏引擎,人人免费可玩
李飞飞押注的世界模型领域有新成果,Odyssey公司由两位自动驾驶大牛创立。其AI无需游戏引擎,40毫秒/帧实时生成视频,玩家能实时交互。虽处于早期预览版,但已展现潜力,世界模型或成竞争热点。
DASF:可落地,易执行的AI安全框架
随着AI广泛应用,安全担忧增加,需系统方法论梳理和消减风险。此前Google的SAIF框架原理完整但操作性差,此次介绍Databricks的DASF框架,具体易落地,介绍通用数据中心AI系统四阶段、12组件及62个安全风险与消减方法。
OpenAI:GPT-5就是All in One,集成各种产品
OpenAI研究副总裁剧透GPT - 5将整合Codex、Operator等产品。团队分享Codex详情与未来计划,回应10大问题,如语言选择、运行方式等,还将推免费API积分,发布了Codex上手指南。