新闻类播客」共找到 3849 篇相关文章

产品应用8

英伟达发布物理AI和机器人顶级开发平台Nvidia Jetson Thor

英伟达官网发布专为物理AI和人机器人打造的顶级平台Nvidia Jetson Thor。其AI计算能力强劲,相比NVIDIA AGX Orin性能和能效大幅提升,硬件配置、存储、多媒体处理及相机支持等方面表现出色,能应对复杂场景。

AIGC开放社区
产品应用8

百度造了个“AI星舰”?或成业界最完备的企业级AI平台

在2025百度云智大会上,百度智能云千帆企业级AI开发平台发布4.0版本,核心聚焦Agent。它一站式提供开发所需能力,解决模型选型、数据盘活等难题,还有RFT工具链降精调门槛,“白盒化”助问题诊断。

InfoQ
开源动态9

4 个月狂飙 22k Star,这本书凭什么?

Github上超火的开源项目《LLMs-from-scratch》中文版4月上市,4个月涨超22k Star。作者实操搭建GPT - 2模型,涵盖大模型构建全流程。用PyTorch开发,代码少且有注释,对初学者友好,豆瓣评分9.3。

AI工程化
产品应用8

DeepSeek-V3.1 发布,官方划重点:Agent、Agent、Agent!

2025年8月21日,DeepSeek V3.1正式发布。它采用混合推理架构,支持双模式,网页端、App、API均升级,上下文拓展至128K。其智能体能力增强,思考与输出效率提升,还具备API特性,模型已开源,价格也将调整。

Founder Park
算法论文8

ICCV 2025 | EPD-Solver:西湖大学发布并行加速扩散采样算法

扩散模型成生成任务主流技术,但逐步去噪机制致推理延迟大。西湖大学提出 EPD - Solver 算法,融合三加速思路优势,可减少积分误差、提升生成质量,还能作插件集成,突破扩散模型速度与质量权衡瓶颈。

机器之心
开源动态8

WAIC抢先爆料:金融“黑马”大模型超DeepSeek刷SOTA,论文已上线

WAIC期间,蚂蚁数科金融推理大模型发布会未开,论文已上线。其模型Agentar - Fin - R1有8B和32B版,在金融测评集超DeepSeek等,还兼顾专业与通用,蚂蚁数科还提出评测基准Finova。

量子位
算法论文8

0.016%参数撬动18%性能:关键表征微调破解LLM推理瓶颈

大语言模型在推理任务依赖思维链技术,传统PEFT方法需修改大量参数,兴ReFT虽只需调整少量参数,但存在不足。本文提出CRFT,仅用0.016%参数量就提升性能,为轻量化推理增强开辟路径。

深度学习自然语言处理
开源动态8

刚刚!Qwen3深夜升级,碾压Kimi K2和DeepSeek V3

通义千问更旗舰版Qwen3模型,推出Qwen3 - 235B - A22B - Instruct - 2507 - FP8。模型通用能力显著提升,在多测评中超Kimi - K2等模型,还增强多语言覆盖等性能,已在魔搭和Hugging Face开源。

新智元
算法论文8

工行x上交大发布多智能体研究成果,通过群体智能刷翻译高度!

2025年多智能体系统成大模型研发高地。工行大数据和人工智能实验室与上海交大人工智能学院推出多智能体翻译系统TACTIC,以认知翻译学为指导,在相同模型配置下提升翻译效果,在小模型下提升更明显。

深度学习自然语言处理
新闻资讯8

刚刚,OpenAI 发布了GPT-5 前菜:ChatGPT Agent

OpenAI发布ChatGPT Agent,它是统一智能代理系统,融合多种功能与工具,能动态选处理路径。在多测试中表现佳,采用强化学习微调架构。使用体验似与人协作,OpenAI采取安全措施,还探索商业、分批开放,业内看法不一。

AGI Hunt