Circuit Bloom

Hi, I'm Sakuraine👋🏻

I am a Full stack developer, welcome to my website.

I have two lovely 🐱, one is Zhuangzhuang and the other is Nico. I love them ❤️. I will share their daily moments on my website.

My hobbies are motorcycle 🏍 and road bike 🚴🏻.

I am currently studying AI and will share my learning experience on my homepage.

📡 Latest Feed
View all
2 updates
AI

OpenAI 发布 GPT-6 与全新「智能界面」

2026-10-07 OpenAI

OpenAI 推出 GPT-6,并同步上线 ChatGPT「Intelligent UI」更新,让回答中直接嵌入图片、图表与可交互按钮。这是 ChatGPT 迄今最重大的一次界面与模型双重升级。

Google 将 Agentic AI 引入 Gemini,先从企业场景落地

2026-10-08 TechCrunch

Google 发布面向工作任务的「一站式」Gemini 智能体,率先向企业用户开放,标志其把 agent 能力产品化、商业化。同期 Google 还上线了可完全离线转写会议的 AI 笔记应用。

Anthropic 推出面向开源项目的免费 AI 安全扫描

2026-10-08 The Verge

Anthropic 为开源项目提供免费的 AI 安全扫描服务,同时更新使用政策,明确禁止「虐待或残忍对待 Claude」的行为以及干预选举,收紧模型滥用边界。

OpenAI 被曝收入比此前预期低 200 亿美元

2026-10-08 TechCrunch

报道称 OpenAI 的实际收入比此前对外预计低了约 200 亿美元。叠加 USA Today 成为最新一家起诉 OpenAI 的出版商,其商业化前景与版权压力同时承压。

Nvidia 押注「物理 AI」,瞄准更安全的 Robotaxi 与人形机器人

2026-10-08 Ars Technica

Nvidia 大举布局物理 AI,目标指向更安全的自动驾驶出租车与人形机器人。不过 MIT Tech Review 泼冷水:机器人领域的 AI 突破短期内难以真正改变日常生活。

Mistral 称新模型「Le Chonk」可挑战最强 AI 模型

2026-10-07 Ars Technica

法国 Mistral 发布新模型 Le Chonk,宣称其能力足以挑战当前最顶尖的 AI 模型,继续在欧洲本土大模型赛道上加码。

中国 Manus 与 Meta 分手后首轮融资超 5 亿美元

2026-10-08 TechCrunch

中国 AI 公司 Manus 在与 Meta 分拆后完成首轮融资,金额超 5 亿美元。同期 AI 排行榜网站 Arena 估值 10 个月内近乎翻倍至 31 亿美元,AI 一级市场热度不减。

Microsoft 发布新款 AI PC 与改版 Windows 11

2026-10-07 TechCrunch

Microsoft 推出搭载 Nvidia 芯片的新款 AI PC 并更新 Windows 11,把 AI 能力进一步下沉到终端硬件与操作系统层面。

Weekly Papers

本周(10/2–10/9)AI 重要论文:

AI 论文周报

  • RoboJEPA: Scaling Robotic Latent World Models —— 基于 JEPA 的机器人世界模型,在横跨 12 种机器人本体的数据上训练。核心发现:其“想象误差”(latent rollout 误差)随算力呈二阶幂律,可据此在远超出拟合规模的区间外预测模型质量;下游规划性能随算力可预测提升,且与想象误差强相关——可作为真机评测的可靠代理指标,支持零样本部署为机器人 agent。 • arXiv cs.AI / cs.RO, 7 Oct 2026

  • SciExam for ENSO: Can AI Agents Build Climate Models? —— 全新科学基准:让 agent 用真实观测、在 6 小时预算内从零构建厄尔尼诺-南方涛动(ENSO)的低阶随机模型,诊断工具写完后冻结、只能作为反馈。隐藏评分器检验模型能否复现 ENSO 统计、恢复未观测变量、预测留出年份。12 个 agent 系统中 6 个得分超过已发表模型。 • arXiv cs.AI / cs.LG / physics.ao-ph, 7 Oct 2026

  • Before They Can Solve: Predicting Post-Training Coding-Agent Performance from Base Models —— 解决“哪个 base checkpoint 值得砸钱做 agentic 后训练”的问题。把成功的后训练轨迹当作 base 模型潜力的前瞻信号:重放每条轨迹、在每个改动代码的步后重跑测试,定位“决定性步骤”(累积补丁首次让仓库由失败转通过的步)。比端到端 pass@K 和单轮任务更贴合多步工具使用的真实能力。 • arXiv cs.AI / cs.SE, 7 Oct 2026

  • AgentTime: Can Agents Estimate and Control Their Own Runtime? —— 首个考察 agent 时长控制能力的基准,含 222 个任务(编码、computer use、agentic work、自动研究)。仅追加一句“工作多久”的指令,从约一分钟到数天不等。误差惊人:Claude Code 里的 Fable 5.1 典型偏差达 2.9×,而 Codex 里的 GPT-6 Astra 仅 1.2×;但时长匹配本身并不等于任务质量达标。 • arXiv cs.AI, 7 Oct 2026

  • DrugTargetWorld: A Synthetic Biobank for Training and Benchmarking AI Scientists —— 面向药物靶点发现的仿真生物样本库框架:程序化生成“世界”,每个含 5.4 万名参与者(基因型、蛋白、健康记录、结局、合成 MRI),因果结构已知但隐藏。Agent 需构建疾病表型、识别因果驱动蛋白、推断调控方向,可选做虚拟“湿实验”。在 20 个心血管世界、540 个 episode 上评测 9 个 agent,Opus 5 与 GPT-5.6 Sol 领先(百分制 39.98 / 35.38)——整体得分仍低,任务远未解决。 • arXiv cs.AI, 7 Oct 2026

  • World Potential Model: Pretrained World Knowledge as Progress Potentials —— 长程语言 agent 通常只有终端奖励,难分辨中间行为是有进展还是停滞。作者提出 World Potential Model(WPM):用预训练模型自身的世界知识识别任务相对进度,无需为每个任务训练单独 value function 或过程奖励模型。在 ALFWorld / ScienceWorld 上,现成预训练模型显著优于随机;把进度锚定到任务里程碑得到标量势能后,其时序差分提供步骤级 credit,匹配比较下优于仅用结果奖励。 • arXiv cs.AI, 7 Oct 2026

  • SkillForge: Co-Evolving Skills and Agents via Dynamic Skill Lifecycles —— 记忆增强 RL 中“技能”是一类重要记忆,但无差别保留会让过时/有害条目累积并误导 agent。SkillForge 用适应度驱动的技能生命周期(trial → active → stable → retired)让技能与策略共同进化:先以 base 模型自身 rollout 预淘汰低适应度技能,再 SFT 播种、进入 RL,每轮做选择性淘汰、稳定化与 LLM 引导变异。 • arXiv cs.AI, 7 Oct 2026

  • Fault-tolerant foundation models —— 反直觉结论:LLM 可以被训练到容忍不可靠硬件,且误差韧性随模型变大而增强,而非退化。基于 4 万 GPU 小时、在模拟故障数字硬件上的训练推导出修正版神经缩放律,暗示模型学会在“好”的纠错码内计算、其相对开销不随模型增大而发散。作者猜想经适当训练的 LLM 或可形式化容错——若成立,在低能耗故障硬件上跑推理可能是显著省电的路径。 • arXiv cs.LG, 7 Oct 2026

Latest posts
See all posts
github
Contact Me

If you want to get in touch with me about something or just to say hi, reach out on social media or send me an email.