Ilya Sutskever 创立的 SSI 首个模型方向曝光,主打持续学习,意在解决大模型顺序训练中的灾难性遗忘问题。这标志着安全超级智能路线开始从概念走向具体模型发布,对关注基座训练方法与新模型动态的从业者是一个重要信号。
每天 04:00(Asia/Shanghai)自动抓「昨天」一天的新内容。
Ilya Sutskever 创立的 SSI 首个模型方向曝光,主打持续学习,意在解决大模型顺序训练中的灾难性遗忘问题。这标志着安全超级智能路线开始从概念走向具体模型发布,对关注基座训练方法与新模型动态的从业者是一个重要信号。
马斯克Grok 4.6重回一梯队!更低价格反超Fable 5,这Cursor是真没白收购
xAI 发布 Grok 4.6,在更低价格下性能反超 Fable 5,重回第一梯队;同时收购 Cursor 后推出的马斯克版 Workbuddy 也一并亮相。这显示 xAI 正以编程助手和 Agent 场景为抓手,同时推进模型能力与开发者工具生态。
从亚百毫秒级启动到生产级部署,腾讯云为何重构 Agent 沙箱?
腾讯云重构 Agent 沙箱,将启动延迟降到亚百毫秒级,并面向生产级代码执行与隔离需求重新设计。这对需要在高并发、低延迟场景中运行不可信 Agent 代码的团队,提供了更可用的基础设施选项。
一家端侧算力/Agent 芯片公司获得 4.8 亿美元融资,其首颗 AI 芯片已进入量产,方向瞄准端侧推理与智能体场景。在云端成本与延迟压力下,端侧算力正成为推理部署的新焦点,该进展对芯片与端侧模型落地有参考意义。
Claude一举扫清2000阶以下哈达玛矩阵!AI开始清空数学待解列表
Claude 在数学开放问题上取得突破,一次性清算了所有 2000 阶以下的哈达玛矩阵存在性判定,显示出大模型在数学研究中的自动化能力。这为 AI for Math 和模型能力评测提供了新的参考,也说明数学研究不必依赖单一模型。
与运行时无关的 AI 工作流:一种兼顾生产环境稳定性和快速评估迭代的模式
该模式提出与运行时无关的 AI 工作流设计,将工作流定义与具体执行引擎解耦,使同一套流程既能稳定支撑生产环境,又能快速完成评估迭代。对正在搭建 Agent 编排或 AI Infra 平台的团队,这种分离思路有助于降低切换成本与稳定性风险。
具身数据来了实战派!40天2轮融资数千万,瞄准物理AI基础设施
一家具身智能数据公司在 40 天内完成两轮数千万融资,专注物理 AI 数据基础设施,试图重新定义机器人训练数据的采集、管理与供给。具身智能正从模型炒作转向数据工程落地,此类基础设施对训练高质量机器人策略至关重要。
智象未来 (HiDream.ai)算法科学家潘滢炜博士确认出席AICon深圳,将分享“从 Token 预测到状态预测:迈向世界模型的原生全模态之路”
智象未来算法科学家潘滢炜将在 AICon 深圳分享从 Token 预测到状态预测的原生全模态路径,探讨迈向世界模型的核心思路。对关注多模态基座、世界模型和下一代模型范式的研究者与工程师有较高参考价值。
联想集团公布 Q1 财报,营收 1834 亿元人民币,同比增长 43% 创历史新高,AI 服务器业务成为主要增长引擎。这表明企业级 AI 算力需求正在快速转化为硬件厂商的实际订单与收入。
别再所有人平分AI算力:顶级模型给资深工程师才省钱,新人刷题式成长已失效
该观点主张不要所有人平分 AI 算力,而应把顶级模型优先给资深工程师以换取更高产出,并指出新人靠刷题式的成长路径在 AI 辅助下已失效。这对工程团队在算力有限时如何配置资源和调整培养策略有现实启发。
面壁智能正式启动 IPO,由中信证券辅导,成为端侧模型厂商走向资本市场的最新案例。这既反映端侧模型商业化进程加快,也为观察国内大模型公司的融资与退出路径提供了新样本。
高光谱成像能无损评估鱼肉新鲜度,但传统深度学习常忽略该类数据光谱信息占主导、标签有序且训练样本稀少的特点。SGNet 采用轻量的光谱分组卷积架构,将光谱与空间特征提取解耦,以更少的参数适配小样本和有序分类任务。该设计在保证低计算开销的同时提升分类效果,对食品质检等边缘端场景更具落地价值。