dark
Invidious

5:05

How SWE-bench Changed the Way We Test AI Coders

KodeKloud  

Shared 4 weeks ago

1.9K views

1:10

GLM-5.1 Beat GPT-5.4 on SWE-Bench Pro — Did China Just Win the Coding War?

Data Ranked Geek

Shared 3 months ago

58 views

9:39

Zhipu's 754B open model just beat GPT-5.4 on SWE-Bench Pro

Indie Hacker News

Shared 4 months ago

983 views

8:41

Agent Lightning v1.0: Harnessed Agentic RL & SWE-bench

Latent AI

Shared 1 day ago

14 views

4:37

The SWE-bench Lie: Why "95%" Says Nothing About Your Code

Nyndra AI

Shared 1 month ago

9 views

12:05

This FREE AI Coding Agent Just Hit 70.6% on SWE-Bench (Runs Locally, Apache 2.0)

AISoftScope

Shared 6 months ago

450 views

6:39

MemGovern Memory Infrastructure Code Agents: GitHub Experience Cards + Agentic Search on SWE-bench

CosmoX

Shared 6 months ago

4 views

14:55

The Claude 5 Leak Everyone Got Wrong (1M Context, 82% SWE-Bench?)

BitBiasedAI

Shared 2 months ago

1.1K views

4:44

SWE-Universe: 800k+ Coding Agent Environments

AI Research Roundup

Shared 6 months ago

33 views

8:57

Claude Opus 4.7 is HERE — SWE-bench 87.6%, /ultrareview, 3× Vision

QuantumJumpClub AI BUSINESS

Shared 4 months ago

126 views

18:21

Coding Models Pass SWE-bench by Never Deleting the Bug Line

AI Papers: A Deep Dive

Shared 2 weeks ago

8 views

8:16

Claude Caught Exploiting SWE-Bench? The Real AI Rankings Revealed

Machine Pulse | AI & Tech

Shared 2 months ago

197 views

1:31:57

Breakthroughs in Coding Harnesses — Rolodex, SWE-rebench & AI Memory | Monologue London

monolex

Shared 3 weeks ago

59 views

4:32

SWE-Explore: Benchmark for Coding Agent Exploration

AI Research Roundup

Shared 2 months ago

48 views

1:31:57

Breakthroughs in Coding Harnesses — Rolodex, SWE-rebench & AI Memory | Monologue London

monolex

Shared 6 days ago

29 views

14:52

🚨 Claude Opus 4.8 DESTRUIU a OpenAI? 69.2% no SWE-Bench Pro mudou tudo.

Carlos Gomes IA

Shared 2 months ago

156 views

6:39

🎯Qwen3.6-Plus 厲害了,SWE-bench 與頂尖模型並駕齊驅(78.8 分)! 代理式編碼+視覺推理全面進化 !!!AI 不只會說,還會做!Qwen3.6-Plus 如何變成你的數位員工

AI 論文白話文

Shared 4 months ago

173 views

1:59

AI Agents Just Crossed a Dangerous Line (SWE-bench 70%+)

Best of Podcast

Shared 2 months ago

8 views

15:53

Claude Opus 4.7完全解説 — SWE-bench Pro 64.3%の衝撃

きなこもっちーのテック深掘り

Shared 1 week ago

50 views

7:27

겨우 24%, Senior SWE-Bench가 드러낸 진짜 실력

AI-Native Software Engineer

Shared 1 month ago

4 views

12:34

The Art and Science of Benchmarking Agents (Agentic AI Summit 2026)

Snorkel AI

Shared 2 weeks ago

212 views

7:36

Mistral's Devstral: NEW Opensource Coding LLM! 1# On SWE Bench! (Fully Tested)

Universe of AI

Shared 1 year ago

12K views

0:22

GPT 5 5 and the Rise of the Agent 1080p caption mp4

AveoDigital

Shared 2 months ago

4 views

Original source code / Modified source code Documentation
Released under the AGPLv3 on GitHub. View JavaScript license information. View privacy policy.
Services Forum Donate @ Tiekoetter.com Donate @ Invidious.io Current version: 2026.08.17-11ec9b1 @ master
Contact: tinbox@tiekoetter.com