「千帆4.0」共找到 2463 篇相关文章
「回答一切」吐槽潮中 Sam Altman 确认: 4o 回归,GPT-5 将进行六大改进
OpenAI在Reddit举行GPT - 5问答活动,网友吐槽多。Sam Altman确认GPT - 4o回归,还表示GPT - 5将进行加倍调用速率、保留旧模型选择权等六大改进,同时回应了用户对旧模型、调用限额等方面的质疑。
全网挤爆Seedance 2.5,但2.0 fast降到6毛是真的香!
近期AI视频赛道竞争激烈,FLUX 3登场,国内巨头也纷纷推出新模型。字节Seedance 2.5优势明显,但适用特定场景。Seedance 2.0 fast降至6毛每秒,经多场景实测,表现均衡,是性价比之选。
MCP for 可观测2.0,6个让MCP开发更高效的小妙招
文章介绍MCP这一开放协议,它能标准化AI模型与不同数据源和工具连接。分享配置MCP开发所需客户端、API等步骤,阐述阿里云可观测2.0融合MCP的实践及效果,还给出设计MCP Server的6个经验,最后展望了MCP应用场景和可观测2.0+AI未来。
Grok 4作战图刷爆全网,80%华人横扫硅谷!清华上交校友领衔,95后站C位
Grok 4一夜爆火硅谷,一张内部作战图显示其幕后团队华人学者占比达80%,包括Jimmy Ba、吴怀宇等。独立评测中Grok 4成绩优异,但也有人质疑其代码基准结果有过拟合嫌疑。
Lovable 一个月新增 1 亿美金 ARR,Replit 再融 4 亿美金 Cursor 打算融 50 亿美金
今年AI Coding赛道增长疯狂且用户付费意愿强。Lovable ARR突破4亿美金且增速加快,年底或破10亿;Replit官宣新一轮融资,推出Agent 4;Cursor拟融50亿美金,其CEO称AI软件开发进入新阶段。
Claude最强领域被GPT反超!GPT 5.5最难编程基准破0
编程领域曾由Claude引领,如今GPT 5.5在大模型解决率为0%的最难编程基准上实现突破。程序重建基准测试(ProgramBench)考验严苛,过往模型解决率为0,GPT 5.5高和超高推理模式成功破局,展现了不同解题风格。
阿里 Qwen3.8 正式发布:2.4T 规模,自主编程 16 天搓出一个 Hermes Agent
8月3日,阿里巴巴发布新一代基座大模型Qwen3.8,总参数量2.4万亿,性能居全球第一梯队。其API已上线千问AI平台,还接入“千问办公”。Qwen3.8编程和办公能力强,还将开源,性价比高。
贴脸对打Opus 4.5!最新Codex自己写自己,网友实测“放手”8小时不崩
Claude Opus 4.6发布不到半小时,OpenAI就上线GPT - 5.3 - Codex,这是其最强的Agent化编程模型。它多项跑分超Claude Opus 4.6,网友实测长链路稳定性好,虽慢但稳。OpenAI总裁称Agent正重构软件开发。
Claude Opus 4.1 上线,SWE-bench 验证率 74.5%,重构可靠性与安全性全面升级
Anthropic推出Claude Opus 4.1,是Opus 4重要升级版。SWE - bench验证率从72.5%提至74.5%,多文件代码重构可靠性及长链交互推理能力增强,无害响应率提升,合作率下降,定价不变。
马斯克20亿送Grok 4上火星!20万GPU造宇宙大脑,一句话生成3D黑洞
发布72小时,Grok 4爆红硅谷,2分钟可部署游戏,一句话直出完整动画。xAI成立两周年,马斯克SpaceX将投20亿,或把模型送上火星。Grok 4算力强,多项基准测试刷新SOTA。