标签: GPT5
降价80%,但这次不只是价格战。OpenAI突然宣布GPT-5.6全线调整,入门
降价80%,但这次不只是价格战。OpenAI突然宣布GPT-5.6全线调整,入门款Luna直接从每百万token输入1美元砍到0.2美元,输出从6美元砍到1.2美元,折合人民币输入才1块3毛5。Terra也降了20%,旗舰Sol价格没动,但出了加速模式,最高快2.5倍,加量不加价。真正值得关注的不是降价本身,而是降价的逻辑,这钱是GPT-5.6Sol自己省出来的。OpenAI说得很清楚:Sol参与了自家生产系统的GPU底层优化,重写Kernel、改进推测解码,端到端成本压下去20%,Token生成效率提了15%。模型自己帮自己降本,降下来的成本又反哺到价格上。左脚踩右脚,飞升循环就这么转起来了。这背后藏着更大的牌:Luna不是拿来干传统杂活的。它能调工具、执行多步工作流,定位是成本敏感型Agent主力。降价80%,本质是在降低Agent长期运行的入场门槛。以前因为太贵不敢频繁跑的审查、验证、监控任务,现在可以变成常规操作。一个飞轮已经成型:模型参与优化自己—成本下降—价格降低—更多Agent工作流跑起来—调用规模扩大—再推动下一轮优化。这不是价格战,这是要把Agent从demo阶段直接推进生产环境。压力现在给到了另一边,该谁出牌了。
【#Gemini掉出全球前十#】当地时间7月21日,谷歌DeepMind发布三款
【#Gemini掉出全球前十#】当地时间7月21日,谷歌DeepMind发布三款轻量的新模型,主打“更快、更智能、更具成本效益”,但因智能程度没有满足外界的期待,评价两极分化。与此同时,旗舰模型Gemini3.5Pro依然没有露面成为此次焦点,从排行榜来看,谷歌的模型已经排在十名开外。根据谷歌官方博客,此次发布的三款模型定位不同。Gemini3.6Flash是主力模型,与上一代相比能使用更少的token,在相同成本下提供更高质量的工作;而Gemini3.5Flash-Lite则是快速、成本效益高的选项,适用于日常任务,如处理文档和搜索;Gemini3.5FlashCyber是一种网络安全模型,专为发现和修补关键软件漏洞而构建。但根据评测来看,此次谷歌的新模型在智能上并不出色。AI模型评测平台Arena.ai的研究显示,Gemini3.6Flash在前端代码竞技场中以1537分排名第12位。
DeepSeekV4能超越KimiK3吗这段时间陆续体验了多款国产大模型,两款热
DeepSeekV4能超越KimiK3吗这段时间陆续体验了多款国产大模型,两款热门产品给我的感受完全不一样。目前DeepSeekV4满血版本已经开放灰度试用,核心亮点就是亲民的使用成本,综合性能足以对标海外高端模型,代码处理能力也达到第一梯队水平。搭配峰谷分时计费,整体开销大幅降低,初创团队和中小型开发公司都能无压力上手。新推出的KimiK3走硬核技术路线,超大参数搭配百万字长文本读取能力,在代码专业测评里成绩十分突出。两者发展方向各有侧重,DeepSeekV4主打普惠商用,覆盖各类日常开发场景。如果日常调用量大、需要把控预算,这款模型优势格外突出。国内AI行业这样多元化的发展路线,也能互相促进,整体行业发展越来越好。deepseekv4能超越kimik3吗
DeepSeekV4能超越KimiK3吗国产大模型这场竞争,已经不是“能不能追上
DeepSeekV4能超越KimiK3吗国产大模型这场竞争,已经不是“能不能追上”,而是开始正面比谁更好用了。KimiK3刚凭借2.8万亿参数、100万Token上下文和编程能力刷了一波存在感,DeepSeekV4满血版可能最快今日上线:一个把长任务、写代码和Agent能力推得更高,一个可能继续靠性能与成本之间的平衡抢市场,看起来像是参数王者对上性价比高手。但我觉得,跑分领先不等于普通用户用起来就一定更好。真正决定我会长期使用谁的,还是回答稳不稳、写代码能不能一次跑通、处理长文会不会丢信息,以及接入自己的工作流程后是否省时间。现阶段我更期待先上手DeepSeekV4,看看它能不能保持过去那种简单、直接、成本可控的优势;KimiK3则更适合拿来挑战复杂项目。两款模型谁赢不重要,重要的是国产大模型终于开始在性能、价格和生态上同时较劲了。deepseekv4能超越kimik3吗科技先锋官
KimiK3发布真的被这次Kimi全新K3狠狠惊艳到,国产开源模型直接刷新纪录!
KimiK3发布真的被这次Kimi全新K3狠狠惊艳到,国产开源模型直接刷新纪录!2.8万亿超大参数搭配百万token超长上下文,一整篇代码仓库、长篇文献丢进去都能完整读懂,读写逻辑丝滑顺畅。原生搭载视觉多模态,看图写代码、对照画面修改设计都能一键搞定。专门针对编程、深度研究优化,自主调试程序、修复报错不用反复指令,开发者办公效率直接翻倍。全新注意力架构大幅提速,长文本加载不会卡顿。最戳人的是全面开放使用,网页端、代码工具、API同步上线,普通爱好者和技术从业者都能上手实测。