「AI成本」共找到 10485 篇相关文章
传Claude sonnet 5即将发布:能自动组建开发团队,一人即一公司,价格爆降50%
小道消息称Anthropic下一代AI模型Claude Sonnet 5或于北美时间2月3号发布,代号“耳廓狐”。它有全新功能,能化身虚拟开发团队,编程能力强,价格将降50%,还与谷歌深度合作。
这个项目让 Clawdbot 接入飞书机器人,附教程!
该项目解决 Clawdbot 官方不支持国内通信软件问题,提供飞书等国内 IM 平台与 ClawdBot AI Agent 的桥接服务,文中介绍前置要求、安装、使用、开发等内容,还给出项目地址和教程。
0.005%参数量超越SOTA!提升模型能力无需庞大奖励模型
上海交通大学等校联合团队提出轻量级奖励模型SWIFT,利用大模型隐藏状态线性特征,仅训练极小线性层,在推理任务中超越主流奖励模型,实现计算效率与准确率双提升,且在多领域表现出色。
拒绝计算“一视同仁”!Elastic Attention:让大模型学会“看人下菜碟”
现代大语言模型用全注意力机制计算复杂度高,现有混合注意力策略是静态的。为此提出Elastic Attention,引入轻量级Attention Router,具备动态路由等亮点,在主流模型测试中效果好。
真·开外挂!MIT新研究:架构0改动,让大模型解锁千万级上下文
MIT CSAIL团队提出递归语言模型RLM,不改动模型架构,让GPT - 5、Qwen - 3等模型具备千万级token超长文本处理能力。它将上下文处理“外包”,实验显示其处理规模超前沿模型,复杂任务优势显著,多数场景性价比高。
Anthropic:大模型开始意识到自己在想什么!
Anthropic的Jack Lindsey论文《Emergent Introspective Awareness in Large Language Models》对大模型做神经科学受控实验。发现Claude Opus 4/4.1能感知内部念头,区分内外状态,通过检查内部状态一致性判断输出意图。
穷人福音!MIT研究:不用堆显卡,抄顶级模型作业就成
MIT研究把59个不同模型凑一起,发现强大模型对物质理解趋同,且性能越强思维越接近。研究还指出性能不佳模型的问题,认为可通过模型蒸馏让小模型模仿大模型,实现算力自由。
9.1K Star!这个工具把 Claude Code 的幸福感拉满了,终于不用手撸 JSON 配置了!
Claude Code等让开发者回归终端开发,但配置“反人类”。GitHub上的cc-switch工具基于Rust + Tauri开发,支持多款模型快速配置切换,有可视化面板及多种功能,还集成Skills库,大大提升使用体验。
Manus被收购,智谱也定了8天后上市
12月30日智谱启动港股招股,1月8日将挂牌上市,拟发售3741.95万股H股,每股116.20港元,预计募资43亿港元。其基石投资者认购近七成,技术以GLM为核心,模型表现出色,但上市后面临诸多挑战。
谷歌2025年终回顾:Gemini 3领衔,六大领域全线突破
本文回顾谷歌2025年发展,从Gemini 1.5 pro开始有变化,到Gemini 2.5 pro质变。谷歌在模型、产品、创意、科学等六大领域突破,如Gemini 3系列模型表现出色,但Sam Altman仍认为谷歌失败。