「Gemini 3.1 Flash-Lite」共找到 3766 篇相关文章
独家丨MiniMax 高级研究总监钟怡然已于半年前离职
AI 科技评论独家获悉,MiniMax 高级研究总监钟怡然已离职,去向未公开。他曾主导设计 MiniMax - 01,该模型在超长上下文处理能力上表现突出,走出独特架构创新与效率优化路径。
神秘访客、智驾改革、增长放缓,这一年极氪调整了什么|甲子光年
极氪自2024年9月进入频繁调整期,经历组织架构和人事变动,如与领克合并、林杰接管营销等。但调整未显著提升销量,其独立性受冲击,资源被共享,现正重塑豪华品牌定位。
苹果端侧AI两连发!模型体积减半、首字延迟降85倍,iPhone离线秒用
苹果在Hugging Face放出FastVLM与MobileCLIP2两条多模态主线。前者主打「快」,首字延迟压到竞品1/85;后者突出「轻」,体积减半。模型和Demo已开放,开发者可集成开发。
谷歌开源结构化信息提取神器!4K+ Star,精准定位+交互式可视化!
在医疗、法律等领域,手动从非结构化文本提取信息费力,传统NLP工具需复杂训练。谷歌开源的LangExtract是高精度信息抽取Python库,能自动提取结构化信息,有精确源定位等功能,还给出使用示例和典型场景。
推荐!5分钟上手Chrome MCP,替代5个付费AI
作者测试发现Chrome MCP能替代大部分付费AI工具,如Cubox、音频工具等。它能让Claude控制浏览器,操作简单,1小时可配置,还能年省2000元,提升效率。
[Triton编程][基础] Triton Fused Softmax Kernel详解: 从Python源码到PTX分析
文章详细介绍Triton Fused Softmax Kernel实现,从Naive Softmax到Triton实现,分析访存量、row索引计算、num_stages作用等,还修复官方年久失修代码,性能测试带宽吞吐提升约4倍。
模型的自我进化,可能真的开始了。
昨天Hermes Agent更新支持原生Windows,安装简单。它调用量超OpenClaw成榜首,与MiniMax M2.7组合迭代快,能长程干活、自主迭代解bug,还可复刻文档风格样式,两团队正合作后训练项目。
AI写CUDA算子准确率92%,到国产芯片只剩4%?上交方法直线拉升,DeepSeek也适用
GPT-5.2写CUDA算子正确率92%,给华为Ascend NPU写算子仅4%,因公开数据少等致‘新硬件冷启动’难。上海交大团队EvoKernel不训新模型、不标新数据,将GPT-5.2正确率从4%拉到83%,还拓展到DeepSeek架构算子。
零样本 Sim-to-Real !实现五指灵巧手力控抓取与手内操作
ByteDance Seed团队研究论文针对训练真实硬件控制策略难的问题,提出实用强化学习框架。该框架有完整Sim - to - Real方案,结合触觉反馈和关节力矩感知,在纯仿真环境训练策略,可零样本部署在真实五指灵巧手。
一行命令,让任何软件秒变AI神器!这个GitHub项目杀疯了
AI智能体推理强但使用专业软件能力差,现有解决方案不佳。CLI - Anything自动化框架打破困境,能让AI通过命令行控制软件,为13款软件生成CLI,有7阶段流水线,多场景适用,介绍了使用方法和项目地址。