排序
OpenAI首次按下暂停键:Astra模型逼近关键级网络安全阈值,不确定性即风险
OpenAI首次因安全风险暂停Astra模型研发。该模型可能具备关键级网络攻击能力:自主发现零日漏洞并执行完整攻击链。从HuggingFace事件到Astra暂停,AI安全范式正在被重塑。
Meta重启开源路线:Muse Glimmer 30B单卡可跑,扎克伯格呛声闭源AI
Meta发布300亿参数稠密模型Muse Glimmer,Apache 2.0协议开源,4-bit量化后20GB以下,RTX 5090或Mac即可本地运行。扎克伯格发6500字长文呼吁降低开源AI政策限制,直指OpenAI和Anthropic的闭源路...
算力战争2.0:从堆GPU到按Token计费,三条路线正在赛跑
AI算力竞争从单卡TFLOPS转向每Token成本。云天励飞三芯路线、蓝芯RISC-V融合CPU、天数智芯国产GPU对标Hopper——三条路线正在赛跑。大模型价格战的本质是算力效率战。
内测者惊呼宇宙最强:DeepSeek V4 Pro加Harness,国产AI的下一张底牌
DeepSeek V4 Pro正式版及配套Harness工具内测中,X平台用户BruceBlue称其为宇宙最强,直言吊打Claude Fable。SWE-bench上V4 Pro Max与Claude Opus 4.6仅差0.2%。API涨价60%后调用量仍增18%,国...
看完梁文锋三小时闭门会:DeepSeek不涨价,护城河不是技术是团队
梁文锋三小时投资人闭门会记录刷屏。DeepSeek不会涨价,护城河是团队而非技术。V4正式版灰度推送中,五种大模型计价方式正在赛跑。蓝色大鲸鱼游得跟所有人都不一样。
750 tokens每秒:GPT-5.6 Sol加速14倍,Luna成本暴降25倍,AI推理进入实时时代
OpenAI联合Cerebras推出GPT-5.6 Sol超高速模式,推理速度达750 tokens/s,较标准模式提升14倍。Luna小模型成本从33.27美元降至1.33美元,ARC-AGI-3分数从13.3%飙至38.3%。晶圆级芯片打破内存墙...
2026服务器出货量破2104万台:AI算力正式进入”推理为王”时代
2026年全球服务器出货量同比增长43.3%,总量突破2104万台创历史新高。更关键的拐点在于:AI推理算力增速飙升至122%,近乎翻倍式增长,大幅甩开训练算力56%的增幅。AI产业从实验室研发阶段,正式...
月省110万美元:硅谷刮起Chinamaxxing风潮,中国大模型倒逼美国巨头降价
硅谷开发者Ben Cera将AI月支出从120万美元砍到10万美元,靠的是中国开源模型。OpenRouter数据显示DeepSeek调用量超GPT-5.6三倍。Hugging Face报告揭示中国模型参数规模领先美国,一场定价权争夺...










