匠人学院 JR Academy学AI来匠人
匠人学院 JR Academy学AI来匠人

Follow Us

linkedinfacebooktwitterinstagramweiboyoutubebilibilitiktokxigua

We Accept

/image/layout/pay-paypal.png/image/layout/pay-visa.png/image/layout/pay-master-card.png/image/layout/pay-airwallex.png/image/layout/pay-alipay.png
EN

关于公司

关于我们元宇宙课堂新闻资讯匠人工作成为导师匠人导师联系我们匠人商店J3.Club

匠人资源

工作内推匠人活动1对1私教行业白皮书线上学习平台面试中心分享面试经验Internship会员中心

AI 工具

AI 工具箱考证匠 Cert Master求职匠 Job Hunter牛小匠 UniMate AI

AI 学习方向

全部学习方向AI EngineerContext EngineeringVibe CodingPrompt MasterAI BuilderAI 产品经理Python 入门

AI 应用提效

AI 办公提效AI 数据分析AI 财务AI 内容创作AI 视觉创作前端开发Hermes AgentOpenClaw 本地智能体

大学资源

墨尔本大学昆士兰大学新南威尔士大学悉尼大学莫那什大学阿德莱德大学RMITQUTUTS

少儿 AI 教育

Airbotix 少儿 AI 编程澳洲家长实用资料库NAPLAN 成绩单怎么看My School 学校数据指南悉尼私校学费 2026少儿编程课程与训练营

移民服务

澳洲移民技术移民189/190/491雇主担保482/186/494投资移民188/888英国移民美国移民加拿大移民

企业合作

P3职业孵化器Enterprise (EN)企业培训实习合作招聘合作申请合作

求职代理

岗位代投职位监控LinkedIn代运营LinkedIn人脉代加了解P3项目

匠人支持

FAQsTerms & ConditionsPrivacy PolicyCancellation & Refund PolicySite map

Top Categories

Web全栈班DevOps项目班数据工程全栈班数据分析项目班编程入门班Business Analyst实习算法集训营

求职就业

BA和产品经理实习数据科学实习数据分析实习Marketing实习简历修改面试指导导师指导VIP

地址

Level 10b, 144 Edward Street, Brisbane CBD(Headquarter)
Level 2, 171 La Trobe St, Melbourne VIC 3000
四川省成都市武侯区桂溪街道天府大道中段500号D5东方希望天祥广场B座45A13号
Business Hub, 155 Waymouth St, Adelaide SA 5000

联系方式

hello@jiangren.com.au0421-672-555

Disclaimer

footer-disclaimerfooter-disclaimer

JR Academy acknowledges Traditional Owners of Country throughout Australia and recognises the continuing connection to lands, waters and communities. We pay our respect to Aboriginal and Torres Strait Islander cultures; and to Elders past and present. Aboriginal and Torres Strait Islander peoples should be aware that this website may contain images or names of people who have since passed away.

匠人学院网站上的所有内容,包括课程材料、徽标和匠人学院网站上提供的信息,均受澳大利亚政府知识产权法的保护。严禁未经授权使用、销售、分发、复制或修改。违规行为可能会导致法律诉讼。通过访问我们的网站,您同意尊重我们的知识产权。JR Academy Pty Ltd 保留所有权利,包括专利、商标和版权。任何侵权行为都将受到法律追究。查看用户协议

© 2017-2026 JR Academy Pty Ltd. All rights reserved.

ABN 26621887572

首页/资源中心/文章详情
JR Academy · Blog职业洞察

DeepSeek 自研推理芯片 / Grok 4.5 千五百亿参数 / Gemini 3.5 Pro 延期 / Fable 5 全球解禁 / GPT-5.6 三档定价

DeepSeek 秘密研发推理芯片欲摆脱英伟达依赖;xAI Grok 4.5 参数飙至 1.5 万亿;Google Gemini 3.5 Pro 全面重构推迟发布;Anthropic Fable 5 出口管制解除重返全球;OpenAI GPT-5.6 Sol/Terra/Luna 三档定价公开

发布日期2026-07-08
阅读时长3 分钟
作者

快速导航

  • 1. DeepSeek 秘密研发推理芯片,欲摆脱英伟达与华为依赖
  • 2. xAI Grok 4.5 发布:1.5 万亿参数,Grok Imagine 图像生成同步完成
  • 3. Google Gemini 3.5 Pro 全架构重构,正式发布推迟至 7 月 17 日
  • 4. Anthropic Fable 5 出口管制解除,全球用户 7 月 1 日重新上线
  • 5. OpenAI GPT-5.6 三档矩阵定价公开:Sol 旗舰 / Terra 均衡 / Luna 极速

1. DeepSeek 秘密研发推理芯片,欲摆脱英伟达与华为依赖

DeepSeek AI Chip Development

一句话: 路透社 7 月 7 日独家报道,DeepSeek 已悄然启动自研 AI 推理芯片项目,招募工程师并接触制造商,目标是斩断对英伟达 H100 和华为昇腾的依赖。

DeepSeek 这家以「低成本颠覆大模型」著称的杭州公司,正在迈出比优化模型更激进的一步——自己造芯片。据路透社 7 月 7 日独家报道,DeepSeek 已在内部悄然组建芯片研发团队,招募具有推理芯片设计经验的工程师,并已与潜在的芯片制造合作伙伴展开初步谈判。此次研发目标明确聚焦在推理侧而非训练侧,因为推理是 DeepSeek API 日常运营中消耗算力最多的环节。消息人士称,这一项目的战略动机非常清晰:降低对英伟达 H100 GPU 和华为昇腾 910 系列的双重依赖,在美国出口管制的长期压力下为公司争取更多自主权。

这一举动的背景值得深思。自 2025 年初 DeepSeek-R1 以极低训练成本震惊业界以来,DeepSeek 已成为全球 AI 竞争中最重要的变量之一。但算力依赖始终是其阿喀琉斯之踵——英伟达芯片受美国出口管制限制,华为昇腾虽然可用但性能差距明显,国产 AI 芯片生态距离成熟尚有距离。如果 DeepSeek 能够研发出专为自身推理负载优化的定制芯片,将意味着它在算力成本和供应链安全上同时获得突破。这不仅是一家公司的战略转型,更可能成为中国 AI 产业「算力自主」叙事的标志性节点。

对整个 AI 行业而言,DeepSeek 自研芯片的潜在影响是多维度的。其一,如果推理芯片研发成功并降低运营成本,DeepSeek API 的定价可能进一步下探,再次对全球大模型定价基线形成压力。其二,字节跳动、百度等中国科技巨头也在推进自研芯片路线,DeepSeek 此举将加速这一趋势在中国 AI 圈的扩散。其三,对关注 AI 基础设施的投资者来说,这意味着中国 AI 公司正在从「算法层」向「基础设施层」延伸,值得重新评估相关投资逻辑。这是一场刚刚开始的长跑,消息落地时距芯片真正量产可能仍有数年,但方向已经清晰。

来源: Engadget · US News


2. xAI Grok 4.5 发布:1.5 万亿参数,Grok Imagine 图像生成同步完成

xAI Grok 4.5 Launch

一句话: xAI 发布 Grok 4.5,参数量约 1.5 万亿(较一个月前 Grok 4.4 增长 50%),同期 Elon Musk 宣告 Grok Imagine 图像生成功能开发完成,xAI 正式迈入全能多模态时代。

「Grok Imagine 做完了。」7 月 5 日,Musk 在 X 上的这两个词发布,背后是 xAI 在多模态赛道的一个重要里程碑。与此同时,xAI 正式发布 Grok 4.5,其参数规模约为 1.5 万亿,而就在一个月前,Grok 4.4 的参数量约为 1 万亿。如此快速的扩张节奏,在当前主流大模型厂商中几乎找不到先例——大多数公司会用半年到一年时间完成这种量级的迭代。这种加速的底气,部分来自 SpaceX 在 6 月 60 亿美元收购 Cursor 母公司 Anysphere 后带来的编程数据红利,这些 Cursor IDE 的真实使用数据已被纳入 Grok 4.5 的训练,专门强化其代码推理和技术问答能力。

Grok Imagine 的完成是 xAI 走向「全平台多模态」的标志性事件。此前 Grok 虽然在文本推理上有竞争力,但在图像生成领域始终是空白。现在 Grok 的多模态版图逐渐清晰:文本问答、语音对话(Grok Voice)、代码生成(Grok Build)、图像生成(Grok Imagine),再加上 Grokipedia 知识库和 Speech-to-Text API,xAI 正在构建一个围绕 Grok 的完整 AI 工具生态。值得关注的是,xAI 同期还推出了 Voice Agent Builder(beta),一个面向企业的无代码语音代理平台,这意味着 xAI 的商业化野心已经从 C 端消费者延伸到了 B 端企业服务。

对开发者和 AI 从业者来说,Grok 4.5 带来了几个值得关注的机会窗口。首先是 xAI API 的新能力,1.5 万亿参数的 Grok 4.5 在复杂推理和长上下文任务上预计有显著提升,可以作为 GPT-5.6 和 Claude Sonnet 5 之外的第三个高性能选择进行基准测试。其次是 AI 编程工具赛道的格局变化,Cursor 的算力和数据资产并入 SpaceX 生态后,Grok 4.5 对编程任务的针对性优化值得软件开发者重点关注。最后,Grok Imagine 的开放意味着图像生成 API 的又一个强竞争者入场,结合 xAI 的语音和文本能力,多模态应用开发者的工具箱再次扩充。

来源: Silicon Report · xAI Release Notes · Basenor


3. Google Gemini 3.5 Pro 全架构重构,正式发布推迟至 7 月 17 日

Google Gemini 3.5 Pro Rebuild

一句话: Google DeepMind 宣布放弃 Gemini 2.5 Pro 现有架构,从零重建 Gemini 3.5 Pro,新增 200 万 token 上下文窗口和深度推理层,正式发布推迟至 7 月 17 日。

在 AI 竞速的时代,推迟发布往往是一个公司内部对质量底线坚守的信号。Google DeepMind 宣布,原计划更早发布的 Gemini 3.5 Pro 将推迟至 7 月 17 日,而推迟的原因并非常见的「最后打磨」,而是更为彻底的「架构级重构」——团队决定放弃基于 Gemini 2.5 Pro 的现有架构,从头设计新的底层框架。新版 Gemini 3.5 Pro 的核心能力升级包括:将上下文窗口扩展至 200 万 token(超过目前大多数竞品),引入「Deep Think Reasoning Layer」深度推理层用于处理复杂多步骤问题,以及支持自主工作流能力,让模型能够在桌面和浏览器环境中「看、推理、行动」。延期的直接触发因素是早期内部测试发现模型在长链代理任务中 token 消耗过高,需要在发布前完成优化。

这次架构重构背后,是 Google 面临的竞争压力的直接体现。OpenAI 的 GPT-5.6 Sol 已经开始向合作伙伴限量预览,Anthropic 的 Fable 5 刚刚重返全球市场,两家竞争对手都在旗舰模型上发力。Google 选择用一次架构级重构来回应,而不是快速推送一个「凑合用」的版本,这一决策在业界引发了积极评价——Demis Hassabis 的团队显然认为,宁愿晚两周也要拿出真正具备竞争力的产品。200 万 token 的上下文窗口是一个颇具野心的指标,如果落地效果稳定,将是目前主流模型中最大的上下文窗口之一,对法律合规、学术研究、大型代码库分析等场景极具吸引力。

7 月 17 日正式发布后,Gemini 3.5 Pro 将首先在 Google AI Studio 和 Gemini API 上线,随后在 Google Cloud 的 Vertex AI 上提供企业级访问。对使用 Google 生态的开发团队来说,现在是规划测试方案的好时机:准备用于长上下文基准测试的文档集,设计需要 Deep Think Reasoning 的多步骤任务测试用例,以及评估从 Gemini 2.5 Pro 迁移到 3.5 Pro 的成本与收益。如果 200 万 token 窗口的价格具有竞争力,它将让很多目前需要 RAG 分块处理的场景变得更为简单直接。

来源: BigGo Finance · Build Fast With AI · The Silicon Review


4. Anthropic Fable 5 出口管制解除,全球用户 7 月 1 日重新上线

Anthropic Fable 5 Global Access Restored

一句话: 美国政府 6 月 30 日解除对 Claude Fable 5 和 Mythos 5 的出口限制,Anthropic 即日起恢复向全球用户提供访问;同期发布的 Claude Sonnet 5 成为所有 Free 和 Pro 账户的默认模型。

17 天的管制,结束了。6 月中旬,美国政府对 Claude Fable 5 和 Mythos 5 实施出口管制,要求 Anthropic 限制非美国公民的访问。由于 Anthropic 无法在实时情况下核实用户国籍,只能选择对所有用户暂停访问——这一决定影响了包括澳大利亚、欧洲、亚洲在内的大量 Claude 用户。6 月 30 日,美国商务部宣布撤销这一限制,Anthropic 在同一天恢复了 Fable 5 和 Mythos 5 的全球访问,全球用户从 7 月 1 日起可以重新使用这两款旗舰模型。这次插曲留下了一个清醒的提示:即使是最先进的 AI 模型,也可能在没有预警的情况下因地缘政治因素中断服务。

管制解除的同一天,Anthropic 还正式发布了 Claude Sonnet 5,并将其设定为 Claude.ai 平台上所有 Free 和 Pro 用户的默认模型。Sonnet 5 被定位为「有史以来最具自主性的 Sonnet 版本」,在大量任务上的表现接近旗舰 Opus 4.8,但价格(介绍价 $2/$10 per M tokens,有效期至 2026 年 8 月 31 日)远低于 Opus。这意味着 Anthropic 正在执行一个清晰的双轨战略:以 Fable 5 维持旗舰形象,以 Sonnet 5 争夺开发者日常使用场景的市场份额。值得注意的是,分析师预测 Anthropic 年化收入即将超越 OpenAI,并有望比 OpenAI 早一年(2029 年)实现盈利。

对澳大利亚和亚太地区的 JR Academy 学员及从业者来说,这次解禁有几个实际影响值得关注。其一,Fable 5 在 Claude Code 中重新可用,对使用 Claude Code 做工程类任务的开发者来说,最高质量的模型选项恢复正常。其二,Sonnet 5 作为新默认模型,其在代码理解、多步骤推理和长文档分析上的能力提升值得做一轮系统性测试,尤其是对正在评估 AI 辅助工具的技术团队。其三,这次出口管制事件提醒所有依赖单一 AI 供应商的团队考虑「模型备援方案」,将 OpenAI、Google、xAI 等多家供应商的 API 整合进工作流,可以在类似政策风险出现时保证业务连续性。

来源: Anthropic News · Anthropic - Sonnet 5 · Fortune


5. OpenAI GPT-5.6 三档矩阵定价公开:Sol 旗舰 / Terra 均衡 / Luna 极速

OpenAI GPT-5.6 Pricing

一句话: OpenAI 正式公开 GPT-5.6 家族三款模型定价:旗舰版 Sol($5/$30 per M tokens)、均衡版 Terra($2.5/$15)、极速版 Luna($1/$6),三档矩阵明显对标 Anthropic 的 Opus/Sonnet/Haiku 体系。

OpenAI 的「三档定价」策略,是一个教科书级的产品矩阵设计。GPT-5.6 家族包含三款模型:Sol 是旗舰,定价 $5 输入/$30 输出(per M tokens),面向需要最高质量输出的复杂任务;Terra 是均衡版,$2.5/$15,面向日常生产力任务;Luna 是极速版,$1/$6,面向对延迟极度敏感或高频调用场景。这三档定价几乎完美地对应了 Anthropic 的 Opus 4.8、Claude Sonnet 5 和 Claude Haiku 4.5 体系,两家公司在产品策略上的相互借鉴已经显而易见。GPT-5.6 目前处于对信任合作伙伴的有限预览阶段,预计后续几周内向公众开放,现有的 GPT-4.o 和 GPT-o3 系列用户届时将有明确的迁移路径。

这次定价公开的背景耐人寻味。同期流出的市场数据显示,Anthropic 的自我报告年化收入已经超越 OpenAI,且 Anthropic 预计在 2029 年实现盈利——比 OpenAI 早一年。ChatGPT 虽然在 2026 年 6 月跨过了 10 亿月活用户的里程碑,但 Google Gemini 应用的月活也已接近 9 亿,Anthropic 的企业客户渗透率增长迅速。OpenAI 以 GPT-5.6 三档矩阵发动价格攻势,一方面是对 Anthropic Sonnet 5 竞争力的正面回应,另一方面也是在 Gemini 3.5 Pro 发布前抢占开发者心智的战略布局。可以预见,7 月 17 日 Gemini 3.5 Pro 发布后,三大平台之间将出现一轮新的性价比对比浪潮。

对开发者和 AI 技术选型决策者来说,现在是建立系统性评估框架的好时机。当 GPT-5.6 Terra($2.5/$15)、Claude Sonnet 5($2/$10 介绍价)、Gemini 3.5 Flash 等中间档位模型同台竞争时,单纯看定价已经不够——需要在自己的真实任务上跑基准。建议重点对比的维度包括:代码生成准确率(Cursor 数据加持的 Grok 4.5 和 GPT-5.6 在此有先天优势)、长文档理解(Gemini 3.5 Pro 的 200 万 token 窗口可能是决定性优势)、多步骤推理(Claude Sonnet 5 和 Sol 的深度对比)、API 稳定性和延迟(Luna 对标 Haiku 的速度赛道)。模型竞争从未像今天这样对用户友好——竞争的结果是更低的价格和更好的性能,关键在于找到适合自己业务场景的那一款。

来源: Releasebot OpenAI · Fortune · Open Data Science

作者
一键分享或复制链接
Lightman Wang
Reviewer: Lightman Wang

Founder of JR Academy

查看该作者的更多文章 →

相关学习资源

  • AI 学习中心
  • Prompt 工程入门
← 上一篇发现这个AI Agent仓库,上百个projects全开源下一篇 →26S2悉尼大学O-Week羊毛攻略!礼物拿到手软

相关文章推荐

GitHub Copilot 实战指南 — 常见问题、定价与选型建议

2026-09-25

GitHub Copilot 实战指南 — 进阶玩法:Coding Agent、自定义指令与 MCP

2026-09-25

GitHub Copilot 实战指南 — 核心功能深度解析:补全、Chat 与 Agent Mode

2026-09-25

GitHub Copilot 实战指南 — 快速上手:注册免费版 + 第一次 AI 编程

2026-09-25

GitHub Copilot 实战指南 — GitHub Copilot 是什么:全球最大的 AI 编程助手

2026-09-25

Continue 实战手册:开源 AI 编程助手完全指南 — Continue 常见问题 FAQ:避坑指南与选型建议

2026-09-25
查看全部文章 →
JR Academy
全球华人学习 AI 第一站
✓15000+ 学员
✓50+ 课程
✓AI 驱动学习平台
训练营免费资源AI学习职业辅导
精选推荐
AI 职业影响地图
测测你的职业风险等级,查看转型路径与学习方向
热门工具
AI & 数据训练营
系统化课程 + 真实项目实战,快速提升竞争力
热门课程
1v1 就业辅导
资深导师一对一指导,简历优化 + 面试准备
就业保障
企业内训定制
AI 技能培训方案,助力团队升级
企业服务
热门标签
Vibe CodingAI 编程CursorClaude求职攻略Prompt前端开发后端开发
订阅更新

获取最新 AI 学习资源、技术教程和求职攻略,直接送达邮箱。

我们尊重您的隐私,不会发送垃圾邮件