「可验证推理」共找到 6084 篇相关文章
华为开源7B多模态模型,视觉定位和OCR能力出色,你的昇腾端侧“新甜点”来了
华为推出开源多模态模型openPangu-VL-7B,适配昇腾端侧。它推理性能性价比高,在多核心任务表现突出,技术报告还披露核心技术细节,为昇腾使用者带来新选择,丰富昇腾生态。
终于,NotebookLM 和 Gemini 合体了。这是什么神之更新?
NotebookLM社交账号更新,现用户可将其笔记本上传到Gemini App,Pro会员在Gemini Web版能用此功能。二者合体类似Agentic RAG,但目前整合欠佳,未来体验有望提升。
Soul APP开源了一款高保真播客生成框架,90 分钟对话零崩盘!
Soul APP背后的Soul AI Lab发布开源项目SoulX - Podcast,是高保真推理框架,能生成90分钟以上连贯对话,有多方言切换等功能,或重塑语音内容产业生产方式。
Cursor团队把内部开发流程打包成插件:18个技能+2个规则+1个代理
Cursor团队将内部工作流打包成插件,即插即用,无需第三方服务集成。套件含18个技能、2个规则和1个代理,可通过`/add-plugin cursor-team-kit`安装,插件地址为https://cursor.com/marketplace/cursor/cursor-team-kit。
夜间感知新突破!北航等提出红外主导的高效目标检测方案 | ECCV'26
在复杂视觉场景中,传统RGB - IR多模态检测方法在低照度等场景下因RGB退化影响检测效果。北航等团队提出的InfraNet,以红外为主,用质量感知机制控制RGB引导,在多数据集取得强竞争力结果。
北航,清华,北大联合发布: 异构智能体协同强化学习!
北航、清华、北大联合发布异构智能体协同强化学习论文。提出 HACRL 新范式,实现异构智能体双向互学与独立部署统一;还有 HACPO 算法弥合智能体差异。实验显示性能提升且成本降低,为多智能体协同学习指明方向。
QoderWork Design 上线,设计即代码,不输 Claude Design
阿里 QoderWork 上线设计工作台,定位用自然语言做专业设计。与 Claude Design 接近平手且小有优点,有 140 种风格参考,画笔和 Nudge 工具方便修改,产出可直接用于开发的工程文件。
创智刘鹏飞、Sand.ai曹越,两大AI青年学者团队联手,开源音视频基座模型
开源多模态生成领域获架构级底层突破。上海创智学院与 Sand.ai 联合研发的 daVinci - MagiHuman 正式开源,打破开源界音视频联合同步生成三重局限。它采用单流 Transformer 架构,能力强、推理效率高。
重磅!OpenAI深夜发布GPT-6 Astra,总裁Brockman:这就是AGI
OpenAI发布GPT-6 Astra,总裁称实现了AGI。它在多基准测试成绩优异,能独立完成复杂工作,网络安全能力强。但推理难监控,其即日起向特定机构开放,有使用价格标准。
GPT-5.4发布,拥有原生计算机操作能力,像是给OpenClaw量身打造的模型。
OpenAI凌晨发布GPT-5.4,或是4o模型后提升最大的一次。它价格较合理,有原生计算机操作能力,支持100万token上下文,还有工具搜索功能可降47% token损耗,与OpenClaw适配性佳。