底层架构创新」共找到 2750 篇相关文章

新闻资讯8

百度:和大家一起讲 「超级有用」的故事

作者参加百度AI DAY智能云创新行业专场,看到百度全栈AI解决方案矩阵及应用案例。百度通过构建生态、全栈自研、推动科技平权等举措发力AI,诸多应用已取得商业成果,有望在AI商业化长跑中胜出。

MacTalk
开源动态8

The Batch: 859 | Qwen3 的自主智能新进展

不到两周前 Kimi K2 超越其他开源非推理模型,如今阿里巴巴发布基于早期 Qwen3 - 235B - A22B 的三款新大语言模型权重,介绍了输入输出规格、架构设计、性能表现、使用方式等,还进行了性能对比。

DeeplearningAI
新闻资讯7

AI 颠覆的第一个职业是程序员?|GAIR Live

文章围绕“AI颠覆的第一个职业会是程序员吗”展开讨论。嘉宾认为AI Coding尚处早期,有潜力成新工程范式。它面临“幻觉”、上下文窗口限制等瓶颈,未来开发者角色或转变为“业务翻译者”和“需求架构师”。

AI科技评论
算法论文8

攻克「恶意投毒」攻击!华南理工联合霍普金斯和UCSD,连登TPAMI、TIFS顶刊

华南理工大学计算机学院AI安全团队联合国际高校,聚焦联邦学习中防范恶意投毒攻击。提出FedID和Scope两种创新防御方法,前者用多种度量标准和动态加权检测恶意梯度,后者通过逐维归一化等揭示后门维度,均有良好效果。

新智元
推荐文章7

学习 MCP 最好的时机是 7 个月前,其次是现在

文章介绍 MCP(Model Context Protocol),它是实现 LLM 与外部能力高效互联的协议,像 USB - C 接口。其采用客户端 - 服务器架构,可让 LLM 突破能力边界。与 Function Calling 相比,MCP 成本低,能让业务团队参与构建智能体。

阿里云开发者
开源动态8

MiniMax-M1:全球首个开源超长上下文大模型,超越DeepSeek-R1,推理成本仅1/4

MiniMax-M1是全球首个开源超长上下文大模型,刷新三项记录。它采用混合专家架构,闪电注意力让推理复杂度近乎线性增长。CISPO算法加速训练,成本低。在工业级任务测试表现佳,已开源且方便开发者接入。

深度学习自然语言处理
新闻资讯8

谢赛宁开炮,现场打脸CVPR评审!Sora开山之作DiT被拒,怒斥AI学术圈畸形

在CVPR 2025上获年轻研究者奖的谢赛宁批判AI学术界畸形,回顾DiT、SiT论文被拒却成Sora等奠基成果的经历。他借“无限游戏”与“有限游戏”概念谈AI研究,指出应坚持“无限游戏”,打破当前困境。

新智元
Product Application7

文档OCR新范式0.84 页/秒,吊打MinerU Qwen2.5VL

MonkeyOCR采用SRR三元组范式,简化多工具管道,避免整页文档处理低效率。与MinerU、Gemini 2.5 Pro等对比,性能表现优,处理速度达0.84页/秒,但对扫描件效果欠佳,架构含多模型,可通过特定地址测试。

CourseAI
产品应用8

真碾压Sora了!谷歌Veo 3首次实现音画同步,视频模型直接「开口说话」

谷歌正式发布Veo 3,它能生成高质量视频,还能理解原始像素,自动生成与画面同步的对话、多种音效。得益于DeepMind的V2A底层技术,其音画合成功能领先。虽有时长和使用门槛限制,但已足够震撼。

机器之心
推荐文章8

GPT-6 Astra 省 Token & 使用技巧大全

本文原创分享GPT-6 Astra的Token节省与实战使用技巧,通过实测对比不同模型搭配的配额消耗效果,给出排雷指南,还介绍了一款开源工具可将普通ChatGPT网页版爆改成全功能Codex,干货充足实用性强。

AI进修生