任务性能」共找到 3542 篇相关文章

产品应用7

Ollama 推出免费搜索API + MCP集成:Cline、Codex一键接入网络搜索( + Qwen 搭建迷你搜索代理 )

Ollama推出免费Web搜索API,个人使用免费,本地和云端模型均可调用,还出了MCP服务器。它能让开源模型执行长期研究任务,还介绍了用其与Qwen搭建迷你搜索代理及MCP集成的方法。

AI进修生
新闻资讯7

波士顿动力机器狗侧空翻炸场!穿轮滑鞋照样能翻

风头被中国机器人盖过的波士顿动力,让机器狗Spot完成侧空翻等动作。工程师称它并非为空翻设计。空翻是严苛测试手段,能验证系统性能,还透露了训练细节,此外它还将上《美国达人秀》。

量子位
开源动态7

Oxlint 1.0 稳定版发布:基于 Rust 的 JavaScript 静态检查器

Oxlint是基于Rust的JavaScript和TypeScript静态检查器,其1.0稳定版发布。它有快速检测、规则覆盖广等特点,性能比ESLint高50 - 100倍,能处理多文件规则,开发者反馈积极。

InfoQ
开源动态8

腾讯AI Lab开源可复现的深度研究智能体,最大限度降低外部依赖

腾讯AI Lab推出全开源智能体框架Cognitive Kernel - Pro,解决现有开源框架依赖付费工具问题。它有模块化架构等核心设计,创新训练方法,在多任务中表现出色,降低外部依赖,相关论文登HuggingFace热榜。

量子位
算法论文8

ICCV 2025 | SeaS: 工业异常生成+正常合成+精准掩码大一统框架,指标全面碾压SOTA

华中科技大学慢工团队提出少样本工业生成模型SeaS,依托U-Net,只需1 - 3张训练样本,单模型同步实现多样异常生成、正常产品合成及精确异常掩码标注,突破现有方法局限,在主流数据集上超越SOTA。

机器之心
新闻资讯7

Claude Opus 4.1代码实测惊人!OpenAI开源模型却只会写屎山?

昨日,OpenAI、谷歌和Anthropic等发布新模型。Anthropic推出Claude Opus 4.1,虽性能提升不大,但编码能力获大客户认可。实测显示Claude - Opus - 4.1写代码稳,OpenAI新模型表现不佳。

新智元
算法论文8

GPT-5刷屏吊胃口之际,英伟达发出暴论:小型语言模型才是未来

英伟达新论文指出,未来属于小型语言模型(SLM),挑战了智能体需用大型语言模型(LLM)的假设。SLM参数量低于100亿,有低延迟、低成本等优势,还给出从LLM到SLM迁移路线图。

AGI Hunt
算法论文7

BLIP3-o统一图像生成与理解,多模态融合趋势显现

BLIP3 - o致力于统一图像理解和生成,提升生成质量与效率。它融合自回归和扩散模型,采用CLIP + Flow Matching架构等。经训练,在图像理解和生成任务表现佳,指令微调效果显著。

CourseAI
算法论文8

「有望成为Transformer杀手」,谷歌DeepMind新架构MoR实现两倍推理速度

谷歌DeepMind发布新架构MoR,有望成Transformer杀手。它统一实现参数共享、自适应计算,兼顾性能与效率。实验显示其推理吞吐量提升,降低计算需求,但能否取代Transformer存疑。

机器之心
开源动态8

最强3B「小钢炮」,代码数据全公开!推理随意开关,128k超长上下文

Hugging Face推出30亿参数模型SmolLM3,支持128k长上下文,训练等全链路开放。它在架构、数据混合策略等多方面优化,性能超Llama3.2 - 3B等,还公开双模式指令模型构建方案。

新智元