大厂推虾苗」共找到 5547 篇相关文章

开源动态7

Qwen又立功,全球最快开源模型诞生,超2000 tokens/秒!

全球最快开源模型K2 Think诞生,速度超2000 tokens/秒,由阿联酋机构与公司合作出,基于Qwen 2.5 - 32B打造。实测速度快且答案准确,主要为数学理开发,团队已发布技术报告。

量子位
新闻资讯7

Claude估值暴涨300%!全球独角兽字节第三他第四

Anthropic官宣完成F轮130亿美元融资,最新估值达1830亿美元,比上轮暴涨近300%。成立4年成全球第四估值初创公司,Claude Code年收入破5亿美元,融资用于拓展业务与海外广。

量子位
新闻资讯8

谷歌Pixel发布汇总:硬件与软件全面AI化,那谁你就学叭

谷歌2025年硬件发布会展示众多AI能力,如Gemini驱动的健康教练、拍摄指导、智能屏设备等。Pixel 10手机搭载芯片可本地运行模型,还有多项实用AI功能,凸显硬件与软件全面AI化趋势。

歸藏的AI工具箱
新闻资讯7

ChatGPT还没学会打电话,谷歌搜索AI已经替你电话约服务,还会谈价砍单!

谷歌搜索迎来三AI革新,集成Gemini 2.5 Pro模型、可用Deep Search功能,最亮眼的是AI代打电话功能。目前该功能在美国上线,未来将全球广,引发网友对其效果和实用性的讨论。

新智元
新闻资讯8

美国开源被中国甩在身后,套壳创业者更遭惨烈清算!OpenRouter CEO:天天乱用高价AI的员工要小心了

顶级科技播客20VC访谈OpenRouter联合创始人兼CEO Alex Atallah。他指出美国开源模型落后中国,企业怕依赖巨头,AI时代员工成本应动态化,还探讨了模型生态、路由技术等行业热点。

AI科技大本营
算法论文8

LLM后训练太烧钱?清华&腾讯有了破解法门:关键是得会Rollout

模型强化学习后训练中,rollout预算易成瓶颈,且并非所有rollout都有用。清华和腾讯研究者提出TRACE框架,将Agent轨迹视为树,分配预算给易产生“成功/失败对比”的节点,实验显示其效果良好。

量子位
新闻资讯7

OpenAI 全面拥抱 Agentic-First,实测有点扎心

OpenAI发布GPT - 5.6系列,Sol定位长周期Agent,训练目标转向Agentic - First。但目前难以用上Sol,且其评测数据因计数规则差异,还出现变身话痨、少说话和干完活难兼顾的问题。

CourseAI
新闻资讯7

谷歌、OpenAI同日发布模型,一个最快最具性价比,一个主打「人情味」

深夜谷歌和OpenAI相继出新版本模型Gemini 3.1 Flash - Lite、GPT‑5.3 Instant。前者专为规模智能设计,性价比高、速度快;后者让日常对话更稳定实用,减少幻觉,提升了多方面表现。

机器之心
开源动态8

千星项目LLMRouter:多模型路由,16+策略优化

UIUC开源智能模型路由框架LLMRouter,可自动为模型应用选最优模型,有16+路由策略。该框架打通训练、评测等链路,解耦Route与Training模块,支持多轮协同等,还可插件式扩展。

新智元
算法论文8

0.005%参数量超越SOTA!提升模型能力无需庞奖励模型

上海交通学等校联合团队提出轻量级奖励模型SWIFT,利用模型隐藏状态线性特征,仅训练极小线性层,在理任务中超越主流奖励模型,实现计算效率与准确率双提升,且在多领域表现出色。

AIGC开放社区