大语言模型
-
Google官宣Gemini4独占13项榜首,但那些不为人知的「刷分往事」还在
Gemini4发布,在13项评测中拿下第一,单次输出可达100万token,在代码、长文档、漏洞修复等领域表现突出。然而这款产品目前仅向谷歌合作方开放,普通用户无法使用。更令人担忧的是,谷歌曾因Gemini Ultra虚假宣传和Gemini Flash评测成绩大幅下滑等问题饱受争议,这次的榜单成绩是否再次「刷分翻车」仍需观察。
-
胡锡进国庆文章意外「露馅」,豆包提示语被直接转发,他这样回应
国庆期间,资深媒体人胡锡进发表国庆散文,却意外将AI助手豆包的提示语一并发布。事后他澄清使用AI并非代笔,而是辅助口述转写和事实核查。此事引发业界对AI创作边界的深度思考。
-
一句「我爱你们」后,七块屏幕黑了:OpenAI到Anthropic的五年恩怨
2020年那场电话会议后,Dario Amodei带走七名核心成员创立Anthropic。从26页论文到万亿估值,从信任到互相鄙视,这段硅谷最深刻的决裂如何重塑AGI竞赛?
-
Claude Opus 5.5正式开放丨性能媲美旗舰,价格暴跌40%
Anthropic 正式推出 Claude Opus 5.5,新模型输出速度较前代提升超 30%,运行成本下降 40%,在多数任务上表现媲美旗舰 Claude Fable 5.1。API 定价优化至每百万输入 4 美元、输出 20 美元。用户订阅限额提升 20%,周度额度增加 25%。Sonnet 5.5 和 Haiku 5.5 将陆续推出。
-
谷歌「加量不加价」推Gemini 3.8:编程与安全能力新升级
谷歌发布Gemini 3.8系列,含通用版和安全防御版。新模型在维持成本和速度的前提下,显著增强了编程、推理和智能体能力。Gemini 3.8 Flash Cyber针对防御场景优化,漏洞发现和修复性能超越前代。谷歌还将智能体架构应用于视频理解,最高降低88%的Token消耗。
您必须登录才能发表评论。