TypeSafe 发布 Jev,定位为补充慢速大模型的“系统一模型”,主打快速、低成本、校准决策,而不是聊天、写代码或复杂推理。
AIUC CEO Rune Kvist 谈 4000 万美元 A 轮融资、AIUC-1 标准、AI Agent 安全测试,以及当自主系统出错时的责任与保险问题。
AI Evaluator Forum 发布 AEF-1 基线,围绕第三方评估的访问权限、利益冲突、资金关系与透明度提出要求,呼应前沿模型“降速”争论。
Cloudflare 新增“禁止 AI 训练”控制项,允许网站继续被搜索引擎发现,同时拒绝混合用途爬虫将内容用于 AI 训练。
NLP先驱、You.com创始人Richard Socher创办Recursive,押注递归自我改进,目标是打造能加速发明与AI研究的“尤里卡机器”。
DeepSeek V4.1-Flash采用新的因果编码器—解码器架构,并加入原生视觉理解。其重点不只是跑分,而是更高效地处理上下文与长时智能体任务。
FDE 正成为 AI 公司热门岗位,但不同公司对其职责理解差异很大。Vinoo Ganesh 以 Palantir、Citadel 与 Kepler 的经历,解释这一角色的定位、误区与组织实践。
本期梳理 Anthropic 安全事件、OpenAI 产品与治理变化,以及智能体评测、模型工具、机器人和本地推理基础设施的新动态。
一个新的 AEO 追踪项目用 6 种提示词变体、7 个前沿模型和 161 个类别,观察 AI Agent 在推荐产品与服务时的偏好。
作者试用 Grok Bot 后认为,它与 OpenClaw 的差异不在能力强弱,而在抽象层级:前者更像托管电脑,后者更像用户自有平台。
GPT-6 Astra 发布后迅速获得大量关注。文章称其在计算机使用与编程方面达到新高,单 token 更贵,但按任务成本更低。
Muse Spark 1.3 宣称在编码与智能体任务上大幅提升,并将推出开放权重版本;其 API 还提供训练数据授权换取 90% 以上折扣的定价选项。
Cursor被SpaceX收购后,OpenAI计划于11月12日终止其直接模型访问。Cursor称OpenAI模型仅占约5%的用户流量,双方仍在沟通。
OpenAI 公布首款自研推理芯片 Jalapeño 的初步测试数据,称其在真实模型负载下实现更高的每瓦吞吐量和更低端到端延迟,并计划于年底前部署到自有基础设施。与此同时,AI 辅助内核优化也成为这次发布的重要看点。
AI行业再现重磅交易:英伟达被曝将以130亿美元收购Hugging Face。与此同时,智谱发布GLM-5.3-Flash,提供100万Token上下文、3200亿总参数和180亿激活参数,并采用MIT许可证开放权重。
吴恩达近期将 DeepLearning.AI 的关注重点进一步转向 AI Engineering。其判断基于超过 1 万条招聘信息、数十次专家与招聘方访谈、问卷及其他线上数据,并总结出四类关键能力,其中包括 AI 应用构建部署与软件工程基础。


