港科大(广州)」共找到 5083 篇相关文章

算法论文8

经验记忆黑科技:LightSearcher让AI工具调用减39.6%、推理快48.6%

现有的 RL 驱动的深度思考模型系统面临准确率与效率的「跷跷板」困境,北邮百家 AI 团队提出 LightSearcher 框架,解决了这一痛点,在保持准确率的同时,显著提升了工具调用效率。

机器之心
产品应用8

震惊海外开发者!BOSS直聘3B小模型比肩80B,怎么做到的?

BOSS直聘楠北阁团队发布3B轻量端侧小模型Nanbeige4.1-3B,性能震惊海外开发者。团队从多方面改进,如优化推理和偏好对齐,重构训练数据,采用多种强化学习算法,使其性能比肩模型。

AIGC开放社区
开源动态7

Wispr Flow 平替, 这款开源中文语音助手,程序员真该试试,本地离线的中文语音输入神器来了(开源白嫖版)

蛐蛐(QuQu)是开源桌面应用,用本地语音识别模型和配置的语言模型,将语音实时转文字并润色。它主打本地语音工作流,替代Wispr Flow,免月费且保护隐私,适合中文用户。

小华同学ai
新闻资讯8

MiniMax M2 发布即爆,拿下开源模型第一名

10月27日,MiniMax发布新一代文本模型M2及由其驱动的MiniMax Agent。M2是专家混合模型,参数达230B但激活仅10B。它在开源模型评测中夺冠,能低成本、高速度支撑工作流,开发者评价高。

MacTalk
新闻资讯7

一夜裁员4000人!前推特CEO挥刀,硅谷白领的安全感崩了

金融科技巨头Block毫无征兆裁掉4000人,CEO称是智能工具催生新工作方式。但专家指出AI未规模提高生产效率,裁员或因人员臃肿和财务问题,如今白领工作受AI冲击

新智元
开源动态7

实测最新开源的DeepSeek-OCR后,我有些不一样的看法,有些话可能只有我敢说

实测最新开源的DeepSeek - OCR,它并非传统OCR,不适用于传统场景。其最意义是解决模型上下文长度问题,通过文字图片压缩解压提高处理速度。模型功能多样,是让AI看图思考的新思路。

开源AI项目落地
推荐文章8

卡帕西推荐的AI Coding指南:3招教你效率翻倍

神卡帕西和OpenAI总裁转发推荐的AI Coding指南,由Peter Steinberger撰写。指南给出三关键策略,即按任务类型选对模型、重构工作流、做好人机分工,还分享实用小技巧。

量子位
开源动态8

蚂蚁专用模型超越o3!仅用2K训练样本刷新医疗AI榜单纪录

蚂蚁集团联合团队发布《MedResearcher-R1: Expert-Level Medical Deep Researcher》报告,其医学AI智能体MedResearcher-R1用2100条训练样本在医疗基准测试反超通用模型,靠数据、工具、训练方法三创新实现突破。

量子位
算法论文7

英伟达放话:小模型才是Agent的未来!

英伟达论文指出,当前用模型构建AI Agent是资源浪费,提出小模型才是Agentic AI未来,给出三点理由,还提供从模型迁移到小模型的六步流程,并分析三个开源项目,呼吁行业追求效能。

探索AGI
开源动态8

小钢炮开源,一张3090两小时「从零训练0.1B全模态模型」,模型训练彻底平民化

MiniMind - O是开源超轻量级端到端全模态模型,采用双轨架构。仅需一张RTX 3090,2小时就能从零训练全链路。有两套训练数据,具备零样本声音克隆等特点,实现模型训练平民化。

开源AI项目落地