「LLM 模型」共找到 8058 篇相关文章
万帧实时!流式3D重建天花板,被国产开源模型打破了
蚂蚁正式开源 LingBot-Map,这是基于几何上下文 Transformer 的纯自回归流式 3D 重建基础模型。它能在恒定内存下实现超万帧长视频实时三维重建,处理速度约 20 FPS,在多基准测试中超越现有流式方法。
AI Coding 流畅度模型:人机协作中的开发者角色转型与未来演进
生成式 AI 正进入软件开发流程,角色不断扩大。AI Coding Fluency 模型描述团队使用 AI 能力演进,从辅助到自主执行。AI 编程面临信任、上下文、任务设计挑战,关键在于协作方式。
ICLR 2026北京论文分享会启动,直击「AI龙虾」、世界模型新范式
2026 年人工智能领域,「龙虾」(OpenClaw)私人 Agent 助理成人机交互标杆,世界模型受关注。ICLR 2026 4 月将在巴西举行,机器之心 4 月 18 日在北京举办论文分享会,邀大家参与交流。
图像模型今夜变天?谷歌刚刚泄露了「Nano Banana Pro」这张王牌
谷歌DeepMind CEO置顶「预告」,传言中的Nano Banana Pro登场在即。它基于Gemini 3.0 Pro级引擎,速度、画质大幅升级,懂界面排版,创作力强,有望让图像模型迈进「专业级时代」。
媲美Claude 4,支持100万上下文!阿里开源超强代码AI Agent模型
阿里巴巴开源超强AI Agent模型Qwen3 - Coder - 480B - A35B - Instruct,测试分数媲美Claude Sonnet 4,超越DeepSeek。它参数多、支持大上下文窗口,训练数据优质,还进行代码强化学习扩展训练等,有对应命令行工具。
GPT-5几个预测:用户翻倍,编程登顶,屠杀一众模型
OpenAI发布GPT-5,登顶大模型测评榜单。它有统一智能架构,在多测试取得突破,编程能力强击败对手。还改进意图,减少幻觉、增加情感、在健康领域更实用,价格便宜。作者预测其将带来用户翻倍等影响。
Unsloth-MLX:在Mac上微调LLM,代码无缝迁移到云端GPU
对于Mac用户,在原型实验阶段反复租云端GPU是资源浪费。开发者推出Unsloth - MLX,基于MLX框架,让Mac用户本地高效微调大模型,改一行导入语句就能无缝迁移代码到云端,还介绍项目特点、状态等。
55.9K star!微软硬核开源文档转换神器,LLM最佳拍档!
介绍微软开源的轻量级Python文档转换工具MarkItDown,它支持20+格式智能转换为结构化Markdown,专为LLM文本分析场景优化,解决开发者处理多格式文档痛点,还阐述其功能、技术架构等内容。
NVIDIA开源“Banana”级黑科技!会懂物理、理解时间的图像编辑模型!
继谷歌Banana后,英伟达开源物理级图像编辑模型ChronoEdit - 14B,被称‘NVIDIA版的Banana’。它有‘时间观念’和‘物理常识’,能按描述生成符合物理规律图像,适用于多领域。
马斯克悄然发布Grok 4.1,霸榜大模型竞技场所有排行榜
马斯克发布Grok 4.1,同时霸榜大模型竞技场第一和第二。它在思考与非思考模式表现出色,还在新专家榜和职业榜霸榜。此外,它在情商测试表现佳,还加强快速回复、改善幻觉问题,已向所有用户开放。